AI 产品
前沿模型自主AI研究实验缩小与人类记录差距
据Twitter/X AI List报道,一项开放实验测试了前沿模型进行AI研究的能力。实验进行了100多次自主运行,使用10多个模型,在8个H200 GPU上沙箱化运行最长8天,专注于nanoGPT优化器轨道。结果显示,最佳运行将与人类数十人历时数月建立的记录差距缩小了82%。该实验基于推文提供的事实,展示了模型在自主研究方面的潜力。
多来源证据
事件时间线
- Twitter/X AI List我们进行了关于前沿模型如何进行AI研究的最大规模开放实验。