扎克伯格发 Muse Spark 1.3,编程基准反超 GPT-5.6 Sol 和 Opus 5

AI资讯25分钟前发布 Birchway
2.7K 0

Meta 周三推送了 Muse Spark 1.3,扎克伯格自己在社交平台上宣布的,说这是该系列在编程和智能体工作上迈得最大的一步。

先看能拿出手的一条:DeepSWE v1.1 上,Muse Spark 1.3 的成绩压过了 GPT-5.6 Sol、Claude Opus 5 和 Claude Fable 5.1。这是 Meta Superintelligence Labs 第一次在编程这条线上把三家前沿模型同时放在身后。

Meta 首席 AI 官汪滔的说法更直接,称性能已经追平甚至超越主要竞争对手。这种表态在过去两年的 Meta 身上不常见——Llama 系列一直是”开源里最好”的定位,而不是”绝对最强”。

真正让人有点意外的是成本那一头。第三方拿同一个 /design 提示在 FlappyBench 上跑了三家:Muse Spark 1.3、Grok-4.6、Gemini 3.8 Flash。Muse Spark 1.3 花钱最少,结果最好;Gemini 3.8 Flash 花得最多,任务还没跑完。同一天两款新模型正面撞车,一个赢了跑分榜,一个赢了账单,这事本身比谁第一有意思。

Command Code 那边已经把它接进 GOAT、Pro、Max 和 API 全线方案,官方口径是”迄今性能最强、成本最低”,基准达到 Sol 级别。

目前能用的入口是 Muse Code 和 Meta API。扎克伯格另外提了一句,后续会推出开放权重形式发布的 Muse 版本。

这句话的分量不比跑分小。如果一个能在 DeepSWE 上跟 Opus 5 掰手腕的模型最后真的开权重放出来,中间那一档闭源模型的定价空间会被压得很难受。Meta AI 过去靠开源换生态,现在手上第一次有了值得别人认真对待的编程能力。

当然,开放权重什么时候放、放哪个规格、许可证怎么写,一个字都还没说。在这之前,这条消息更像是一张期票。

© 版权声明

相关文章

扎克伯格发 Muse Spark 1.3,编程基准反超 GPT-5.6 Sol 和 Opus 5 暂无评论

none
暂无评论...