Alpha Pulse New

AI 产品

阿里巴巴Qwen发布Qwen3.8-27B模型:单GPU适配,技术规格详解

首次出现 8月15日 02:30·最近更新 8月15日 02:30

阿里巴巴Qwen团队发布了Qwen3.8-27B模型,该模型可适配单个Blackwell GPU,支持多种精度。事实包括:模型采用与2.4T旗舰相同的混合骨干结构,但为密集设计;提供BF16和FP8精度,NVFP4构建来自第三方;原生上下文长度为262K,可扩展至1M;集成MTP草稿头以支持推测解码,接受率在短提示上测量为92.2%(BF16)和84.8%(FP8)。已在NVIDIA GB300上验证端到端功能,支持工具调用和长上下文生成。使用需vLLM nightly和transformers 5.8.0+版本。讨论部分:证据中提到技术优势,如单GPU支持多个长序列,但这些基于特定硬件条件。

多来源证据

事件时间线

  1. 8月14日 23:32
    Twitter/X AI List
    🎉 Qwen3.8-27B 已从 @Alibaba_Qwen 发布,整个模型可适配单个GPU。采用与2.4T旗舰相同的混合骨干结构,密集而非MoE。Day-0支持在vLLM中。
返回新闻流