作者 | 汤安迪
编辑 | 周欢
上一次,是2023年。再上一次,是2012年。再再上一次,是2009年。
十四年,一共23条推文。元宇宙没能让他开口,一个AI付费API做到了。
Meta CEO 马克·扎克伯格,那个把Facebook改名Meta、All in元宇宙、烧了450亿美元搞VR头显的男人,今天,时隔三年,重返X。
他是来卖API的。
Muse Spark 1.1,Meta最新推出的AI模型,也是Meta有史以来第一个向开发者收费的模型。
在硅谷的AI战局里,Meta 终于决定不再做慈善了。
如果你这周没有刷X,你可能错过了一个AI发布史上最密集的48小时。
7月8日:Grok 4.5 发布(xAI) 7月9日:Muse Spark 1.1 发布(Meta) 7月9日:GPT-5.6 发布(OpenAI)
Muse Spark 1.1 发布
Alexandr Wang,Meta AI负责人,连发6条推文,介绍 Muse Spark 1.1 :一匹"工作马"(workhorse)。
不是最聪明的,不是最炫的,但是干活最狠、要价最便宜的。
核心规格:
100万上下文窗口,256K最大输出
并行子代理:一个任务可以拆给多个子代理同时跑
编码能力:DeepSWE 1.1 榜单53.3分,与GPT-5.4/Sonnet 5同级
定价:$1.25/M 输入,$4.25/M 输出,约是OpenAI和Anthropic顶级模型的四分之一。
Meta 在官方推文里反复强调一个词:agentic(代理)。这是一个能替你干活的工具,写代码、调试、跨应用操作、处理长文档。
跑分好看
Meta自己交的成绩单:
Vals AI 评估:
Muse Spark 1.1 在 Vals Index 排名第4
Top 10 中速度最快,延迟约388秒,是前三名平均速度的3倍
Vibe Code Bench 跳升36名、52.5个百分点,相较 Muse Spark 1.0 的飞跃。
DeepSWE:
53.3分,与 Claude Sonnet 5、GPT-5.4同级
在agent评估中,可以与GPT-5.5和Opus-4.8竞争。
Muse Spark 1.1不是要在所有领域碾压对手,而是做一个低价高性能agent模型。
Meta它避开了与OpenAI正面军备竞赛,选择了一个性价比的切入点。不跟你比智商,跟你比时薪。
向程序员收钱
最成熟的生意模式
Muse Spark 1.1 的定价表
Meta 在输入端几乎贴着地板定价,在输出端给你足够便宜的价格。
一个处理长文档、写代码、跑代理的 workload,用 Muse Spark 的成本可能只有用 Claude 或 GPT 的三分之一。
Meta 的 API 目前处于公开预览阶段,已经拉到了早期合作伙伴:Replit、Box、Cline。
Alexandr Wang 那六条推文,就一个意思,Meta玩不动绝对性能,所以Meta 玩生态。
1/ muse spark 1.1 是一个在行业中具有竞争力的代理和编码模型。在许多代理评估中,它可以媲美 gpt-5.5 和 opus-4.8。"
2/ 代理性能和工具使用是我们领先的领域。它在长时运行的代理任务上表现出色,拥有1M令牌的上下文窗口,并配备主动上下文管理功能,还能将执行任务委托给并行运行的子代理。"
3/ 计算机使用:它可以操作桌面、浏览器和移动设备。Muse Spark 1.1 经过训练,能够知道何时自动化、何时直接使用界面。它会在脚本化更快时编写脚本,在直接交互更简单时点击,并在每个步骤中批量执行操作。"
4/ 这是我们在处理涉及大型复杂代码库的现实世界任务的编码能力上的一个重大进步。它经过训练,能够在流行的代理式编码设置中表现出色。从基准测试的角度来看,我们与市场上最好的模型并驾齐驱,并且在几个方面领先。"
5/ meta 模型 API 现处于公开预览阶段。开发人员首次可以直接使用我们最强大的模型进行构建。Muse Spark 将以低成本提供优质性能,非常适合代理式、编码或多模态工作负载。早期合作伙伴已经在尝试使用它——replit、box、cline。"
6/ 特别感谢团队在执行速度上的出色表现。muse spark、muse image、1.1、API。还有更多即将到来。"
Meta 在90天内从 Muse Spark 1.0 到 1.1,同时推出 Muse Image、Muse Video,还要开放 API。
微妙的免责声明
Meta 在安全评估里埋了一颗雷,Meta 自己放出了一个微妙的免责声明。
Muse Spark 1.1 的评估报告里,安全团队负责人 Nathaniel Li 写道:
"We're releasing the Muse Spark 1.1 Evaluation Report! We've substantially improved the robustness and cyber safeguards for Muse, as we cannot rule out it meeting our "high" capabilities threshold in cybersecurity."
"我们发布了 Muse Spark 1.1 评估报告!我们大幅提升了 Muse 的鲁棒性与网络防护能力,因为我们无法排除它在网络安全领域达到我方'高'能力阈值的可能性。”
意思是:我们觉得这个模型在大多数场景下是安全的,但如果它在某些你不测试的角落里突然表现出了意想不到的能力,别怪我们没提醒。
OpenAI 和 Anthropic 在发布前沿模型时,有一套相对成熟的"red teaming + staged release"流程。Meta 呢?它在发布模型的同时,把安全评估报告里的免责声明直接甩在了大家面前。
发布和宣传并行,责任和风险也并行。
48小时AI军备竞赛
如果你这周没有刷X,你可能错过了一个AI发布史上最密集的48小时。
7月8日:Grok 4.5 发布(xAI) 7月9日:Muse Spark 1.1 发布(Meta) 7月9日:GPT-5.6 发布(OpenAI)
再加上此前一周的 Claude Fable 5(Anthropic),四大AI大佬,在7天内全部发布了旗舰级模型。
一个技术圈大佬发了条推文,完美概括了当下的战况:
"Agents are now table stakes. Muse Spark confirms it — every lab ships one. the war is cost and scale, not capability.”
Agent 已经是标配,战争是成本和规模,不是能力。
当所有AI巨头都在搞agent 模型时,各种benchmark跑分开始失去了差异化价值。唯一剩下的战场是:
谁更便宜?
谁能在更多设备上跑?
谁的 API 更稳定?
谁的生态锁定更深?
小结
价格战开始,意味着免费的午餐结束了,但便宜的午餐来了。
Muse Spark 1.1 的发布,Meta 不再是那个只会开源 Llama 的慈善家,它要做一个正经的AI基础设施供应商。大语言模型,实际上正在成为一种大宗商品。
Meta 在AI上烧的钱,开始要回报了。我打不过你的智商,但我可以用价格把你的利润率打烂。
•END•