Alpha Pulse New

AI 产品

GLM-5.3 AI模型基准测试成绩大幅提升,计划两周内开源权重

首次出现 8月14日 18:31·最近更新 8月14日 18:31

根据Twitter/X AI List的社交媒体讨论,有报道称GLM-5.3 AI模型基于相同的743B基础模型,通过后训练在Terminal Bench 3.0基准测试中从4.6分提升到28.3分,在ExploitBench上从24.4分提升到54.4分。此外,GLM-5.3在CyberGym测试中超越了Fable 5和GPT-5.6 Sol模型。计划在两周内开源模型权重。此信息来自非官方社交媒体讨论,具体性能数据可能未经验证,属于报告内容;作者个人观点表达了对该模型的强烈期待。

多来源证据

事件时间线

  1. 8月14日 14:54
    Twitter/X AI List
    这太疯狂了。相同的743B基础模型,但后训练将Terminal Bench 3.0从4.6提升到28.3,ExploitBench从24.4提升到54.4。GLM-5.3甚至在CyberGym上超越了Fable 5和GPT-5.6 Sol。
返回新闻流