AI 产品
开放权重模型Qwen3.8-Max在基准测试中得分最高,略超GPT-5.4和Opus 4.8
根据来自Twitter/X AI List的证据,开放权重模型的最高分为38%,由Qwen3.8-Max获得,这略高于GPT-5.4和Opus 4.8。这一数据点表明,开放权重模型在分布外任务上取得真正进步,尽管该来源非官方,但基于文本内容,事实部分为得分数据,讨论部分为对进步的解读。
多来源证据
事件时间线
- Twitter/X AI List开放权重模型的最高分为38%,来自Qwen3.8-Max。这略高于GPT-5.4和Opus 4.8。我们将其视为开放权重模型在分布外任务上取得真正进步的一个数据点。