AI 产品
AI领域热议:新30M-100M长序列编码基准测试在Twitter上曝光
据Twitter/X AI List报道,一个名为“another 30M-100M long horizon coding benchmark”的编码基准测试被提及。该测试旨在评估人工智能模型处理30M到100M长度horizon(可能指序列或时间范围)的能力,但具体细节如开发者、发布时间或测试方法均未提供。由于来源为非官方社交媒体,此信息目前仅属于社区讨论或传闻,尚未得到官方确认,因此在引用时需谨慎对待。
多来源证据
事件时间线
- Twitter/X AI List另一个30M-100M长的horizon编码基准测试