AI 产品
Muse Glimmer 30B模型在NVIDIA GH200上实现高吞吐量并开放API供测试
基于一条来自Twitter/X AI List的非官方证据,开发者报告称通过DFlash配置,在单个NVIDIA GH200硬件上,Muse Glimmer 30B模型达到了每秒3,323 tokens(tok/s)的性能。这是一个已确认的事实陈述。此外,该开发者宣布开放API供公众试用,并鼓励用户发送困难内容以测试模型极限并提供反馈,这属于讨论或邀请部分,未经独立验证。请注意,此信息未来自官方渠道,互动量不作为可信度依据。
多来源证据
事件时间线
- Twitter/X AI List我将Muse Glimmer 30B置于DFlash之后,在单个NVIDIA GH200上获得了3,323 tok/s。更实用的部分:我开放了API供所有人尝试。