Alpha Pulse New

AI 产品

Grok 4.6 在知识工作和法律基准测试中据称领先

首次出现 8月13日 03:01·最近更新 8月13日 03:01

据 Twitter/X AI List 的非官方发布,AI 模型 Grok 4.6 声称在 GDPVal-AA 和 AA-Briefcase 这两项强大的知识工作和现实世界生产力基准测试中领先,同时在法律基准测试中也表现突出。此外,Grok 4.6 在编码代理和通用智能指标上保持高度竞争力。请注意,此信息来自非官方来源,尚未得到独立验证,可能不构成可靠事实。

多来源证据

事件时间线

  1. 8月13日 01:48
    Twitter/X AI List
    SPACEXAI: Grok 4.6 在两项最强的知识工作/现实世界生产力基准测试(GDPVal-AA 和 AA-Briefcase)以及法律基准测试中领先,同时
返回新闻流