AI 产品
Grok 4.6 在知识工作和法律基准测试中据称领先
据 Twitter/X AI List 的非官方发布,AI 模型 Grok 4.6 声称在 GDPVal-AA 和 AA-Briefcase 这两项强大的知识工作和现实世界生产力基准测试中领先,同时在法律基准测试中也表现突出。此外,Grok 4.6 在编码代理和通用智能指标上保持高度竞争力。请注意,此信息来自非官方来源,尚未得到独立验证,可能不构成可靠事实。
多来源证据
事件时间线
- Twitter/X AI ListSPACEXAI: Grok 4.6 在两项最强的知识工作/现实世界生产力基准测试(GDPVal-AA 和 AA-Briefcase)以及法律基准测试中领先,同时