Alpha Pulse New

AI 产品

Muse Glimmer 30B模型在NVIDIA GH200上实现高吞吐量并开放API供测试

首次出现 8月12日 09:32·最近更新 8月12日 09:32

基于一条来自Twitter/X AI List的非官方证据,开发者报告称通过DFlash配置,在单个NVIDIA GH200硬件上,Muse Glimmer 30B模型达到了每秒3,323 tokens(tok/s)的性能。这是一个已确认的事实陈述。此外,该开发者宣布开放API供公众试用,并鼓励用户发送困难内容以测试模型极限并提供反馈,这属于讨论或邀请部分,未经独立验证。请注意,此信息未来自官方渠道,互动量不作为可信度依据。

多来源证据

事件时间线

  1. 8月12日 05:03
    Twitter/X AI List
    我将Muse Glimmer 30B置于DFlash之后,在单个NVIDIA GH200上获得了3,323 tok/s。更实用的部分:我开放了API供所有人尝试。
返回新闻流