Alpha Pulse New

AI 产品

Muse-Glimmer 30B模型发布FP8-block量化版本

首次出现 8月11日 03:02·最近更新 8月11日 03:02

Muse-Glimmer 30B多模态模型推出新的FP8-block量化检查点,内存和磁盘占用约减少一半。量化细节:线性层采用块状FP8量化,视觉塔保持全精度,使用LLM Compressor工具进行量化,模型已部署在vllm_project上。相关评估结果即将发布。

多来源证据

事件时间线

  1. 8月10日 23:16
    Twitter/X AI List
    Muse-Glimmer 30B,现在支持FP8-block。我们的多模态模型量化检查点,内存和磁盘占用约减半。
返回新闻流