Meta 甩出 Muse Spark 1.1,编程智能体榜单一夜易主

扎克伯格三年来首条推文为它站台

2026-07-22 09:57

7月21日前后,Meta 扔下一颗炸弹:全新编程与智能体模型 Muse Spark 1.1 正式亮相,连沉寂三年的扎克伯格都专门发推文站台。这款模型直接瞄着 OpenAI 的 GPT-5.6 和 Anthropic 的 Claude Opus 4.8,摆明了要在企业开发者钱包里抢地盘。

Meta 发布 Muse Spark 1.1 编程模型
Meta 发布 Muse Spark 1.1 编程模型

亮眼的是一组基准成绩。Muse Spark 1.1 在 MCP Atlas、JobBench、Humanity 的 Last Exam 和 Finance Agent V2 四个衡量智能体能力的榜单上都拿到第一。更夸张的是法律智能体基准 Vals AI Harvey,它拿到 20% 的分数,而 Claude Fable 5 只有 11%,几乎翻倍。对一个新模型来说,这种开局相当凶猛。

长上下文和跨端操作是它的另一张名片。模型配备 100 万词元(token)的上下文窗口,并且能在桌面、浏览器和手机上直接「用电脑」——也就是自己打开陌生界面、在多个应用之间串起工作流,不需要人一步步指挥。早期合作伙伴名单也很豪华:Replit、Cline、Box 都在列。

价格上 Meta 打得够狠。每百万输入词元 1.25 美元、输出 4.25 美元,比 OpenAI 和 Anthropic 的同档产品都低。值得注意的是,它目前仍然是闭源,没有开放权重。这标志着 Meta 从「开源 AI 旗手」转向了双线策略:一边保留开源遗产,一边用闭源模型正面竞争。

执掌 Meta 超级智能实验室的 Alexandr Wang(Scale AI 创始人)给它的评价是「智能体任务和编程最强模型」。话里话外,Meta 已经不满足于当那个开源的好好先生。靠着更低的价格和更强的基准,它想从 OpenAI、Anthropic 手里分走企业开发者的预算。

话说回来,基准第一不等于落地第一。编程智能体的战场,最终要看开发者愿不愿意把核心工作流迁过来。Meta 这次把价格和伙伴牌都亮了出来,但真正考验在于:当企业真的用 Muse Spark 1.1 跑生产任务时,它能不能稳住那份漂亮的成绩单。