Alpha Pulse New

AI 产品

Meta Muse Spark 1.1 AI模型在多项基准测试中表现优异引发关注

首次出现 7月22日 18:42·最近更新 7月22日 21:02

近期,多份社交媒体用户报告指出,Meta公司推出的Muse Spark 1.1 AI模型在性能上取得了显著进展。根据一位用户在Twitter/X上的分享,该模型在“人类终极考试”(Humanity's Last Exam)基准测试中,表现优于其他多个知名模型,包括Opus 4.8 Max、Gemini 3.1 Pro和GPT-5.5 xHigh。另一份评估提及,Muse Spark 1.1在智能体编程和单次推理任务中的表现与Opus 4.8相当,甚至优于Grok 4.5,仅次于少数模型,并具有较高的成本效益。这些评论均来自非官方社交媒体渠道,反映了用户对Meta AI模型能力提升的积极看法和讨论。

多来源证据

Twitter/X AI List·twitter·

我为Meta的回归感到真正的惊讶。

我为Meta的回归感到真正的惊讶。Muse Spark 1.1在人类终极考试中击败Opus 4.8 Max、Gemini 3.1 Pro和GPT-5.5 xHigh,是其中最令人印象深刻的部分。Meta已经在训练更大的模型,如果它很快达到Fable 5级的能力,我也不会感到惊讶。人们在Meta最虚弱的时候怀疑它。团队没有找借口,而是继续工作,现在成果终于显现了。

Twitter/X AI List·twitter·

伙计们,我觉得Meta的Muse Spark 1.1被低估了,大家都忽略了它。试一试吧,它真的没那么差,绝对可以和GPT 5.5、Opus 4.8这样的模型竞争。

伙计们,我觉得Meta的Muse Spark 1.1被低估了,大家都忽略了它。试一试吧,它真的没那么差,绝对可以和GPT 5.5、Opus 4.8这样的模型竞争。

Twitter/X AI List·twitter·

Meta确实发布了一个很棒的模型。看看Muse Spark 1.1。

Meta确实发布了一个很棒的模型。看看Muse Spark 1.1。

Twitter/X AI List·twitter·

我本来非常怀疑,但看起来Meta真的做到了。Muse Spark 1.1与Opus 4.8相当,优于Grok 4.5——坦率地说,它优于除Sol和Fable之外的几乎所有模型,并且价格极具竞争力(它领先我们的成本/性能曲线)。它在我们的多智能体评估套件中的智能体编程和单次推理方面都表现出色。结果将在下周上线,同时我们还在测试的Kimi K3(她是个又大又慢的女孩)也会发布。

我本来非常怀疑,但看起来Meta真的做到了。Muse Spark 1.1与Opus 4.8相当,优于Grok 4.5——坦率地说,它优于除Sol和Fable之外的几乎所有模型,并且价格极具竞争力(它领先我们的成本/性能曲线)。它在我们的多智能体评估套件中的智能体编程和单次推理方面都表现出色。结果将在下周上线,同时我们还在测试的Kimi K3(她是个又大又慢的女孩)也会发布。

事件时间线

  1. 7月12日 23:40
    Twitter/X AI List
    我为Meta的回归感到真正的惊讶。
  2. 7月13日 16:49
    Twitter/X AI List
    伙计们,我觉得Meta的Muse Spark 1.1被低估了,大家都忽略了它。试一试吧,它真的没那么差,绝对可以和GPT 5.5、Opus 4.8这样的模型竞争。
  3. 7月14日 01:56
    Twitter/X AI List
    Meta确实发布了一个很棒的模型。看看Muse Spark 1.1。
  4. 7月18日 02:02
    Twitter/X AI List
    我本来非常怀疑,但看起来Meta真的做到了。Muse Spark 1.1与Opus 4.8相当,优于Grok 4.5——坦率地说,它优于除Sol和Fable之外的几乎所有模型,并且价格极具竞争力(它领先我们的成本/性能曲线)。它在我们的多智能体评估套件中的智能体编程和单次推理方面都表现出色。结果将在下周上线,同时我们还在测试的Kimi K3(她是个又大又慢的女孩)也会发布。
返回新闻流