AI 产品
Opus 5在ARC-AGI-3基准测试中达到30%,创历史新高
基于提供的证据,Anthropic的Opus 5模型在ARC-AGI-3基准测试中取得了30%的成绩,创下新的最高水平。ARC-AGI-3用于衡量模型在没有先前接触过的问题上的解决能力——这是一个历史上扩展模型规模收益最小的领域。该成绩被视为一次显著的提升。
多来源证据
事件时间线
- Twitter/X AI ListOpus 5在ARC-AGI-3基准测试中达到30%,创历史新高
AI 产品
基于提供的证据,Anthropic的Opus 5模型在ARC-AGI-3基准测试中取得了30%的成绩,创下新的最高水平。ARC-AGI-3用于衡量模型在没有先前接触过的问题上的解决能力——这是一个历史上扩展模型规模收益最小的领域。该成绩被视为一次显著的提升。