AI 产品
GLM-5.3 AI模型基准测试成绩大幅提升,计划两周内开源权重
根据Twitter/X AI List的社交媒体讨论,有报道称GLM-5.3 AI模型基于相同的743B基础模型,通过后训练在Terminal Bench 3.0基准测试中从4.6分提升到28.3分,在ExploitBench上从24.4分提升到54.4分。此外,GLM-5.3在CyberGym测试中超越了Fable 5和GPT-5.6 Sol模型。计划在两周内开源模型权重。此信息来自非官方社交媒体讨论,具体性能数据可能未经验证,属于报告内容;作者个人观点表达了对该模型的强烈期待。
多来源证据
事件时间线
- Twitter/X AI List这太疯狂了。相同的743B基础模型,但后训练将Terminal Bench 3.0从4.6提升到28.3,ExploitBench从24.4提升到54.4。GLM-5.3甚至在CyberGym上超越了Fable 5和GPT-5.6 Sol。