巨头亲手改写AI版图
一周三桩大事重塑行业
「AI Agent」这个词近两年被炒得很热,但你不用管那些术语,把它想成一个「能自己定计划、自己拿工具干活的数字员工」就好。过去的聊天机器人,你问一句它答一句,多走一步就要你下指令;而 agentic(也就是「有行动力的智能体」)不一样,你给个目标,它会自己拆解步骤、打开浏览器查资料、在终端敲命令、甚至反复试错直到把活儿干完。理解了这一点,你才能看懂这一周科技圈到底发生了什么——几家巨头同时出手,争的不是「谁的模型聊天更顺」,而是「谁的 AI 能真正替人把事办了」。
先说微软。这家把 Office 卖到全世界桌子上的公司,最近悄悄迈出了「去 OpenAI 化」的第一步。在 Excel 和 Outlook 里,微软开始用自研的 MAI 模型家族,替换掉原本来自 OpenAI 与 Anthropic 的第三方模型。新模型 MAI-Thinking 1 在编码能力上,已经追平了 Anthropic 的 Claude Opus 4.8——这是彭博社援引内部测试的说法。每周,这两款旗舰办公软件已经有数万条 AI 提示请求,完全由微软自家模型在背后处理。
你可能会问:微软不是 OpenAI 最大的金主和合作伙伴吗,为什么要换?根子上是两笔账。第一是成本,调用别人家高价 API 就像租算力过日子,用得越多越肉疼;第二是数据主权,也就是「数据驻留」——企业客户尤其是欧洲和受监管行业,强烈要求数据留在自家地盘、别往外送。微软 AI 部门掌门人 Mustafa Suleyman 正牵头把对高价第三方接口的依赖降下来。目前 MAI 的整体占比还很小,但它更像是插进 Copilot、Azure AI 和整个 Microsoft 365 生态的一块「滩头堡」,先把位置占住。
再看 OpenAI 这边。7 月 9 日,GPT-5.6 系列正式公开,一口气放出 Sol、Terra、Luna 三个模型,覆盖 ChatGPT、Codex 编程工具和对外 API。旗舰 Sol 最值得说——它新增了两档「加力」能力。所谓 max,相当于给模型多分配一些推理时间,让它把替代方案都探索一遍、自己纠错,类似考试时允许你多想几分钟再交卷;所谓 ultra,则是协调四个并行 agent 实例去啃那种又复杂又多步骤的硬骨头,代价是 token 消耗更高、更费钱。Terra 是均衡的日常选手,Luna 则主打最快最省。再往前一天,7 月 8 日他们还推出了 GPT-Live 新一代语音模型,原生实时架构,能打断、能暂停理解、能实时翻译和听写,背后编排着 GPT-5.5,而每周用 ChatGPT Voice 的人已经超过1.5 亿。
Anthropic 的故事则像一部被按下暂停键又重启的剧。7 月 1 日,在 6 月 12 日美国出口管制解除之后,Claude Fable 5 恢复了访问——它之前因为 Amazon 的研究者发现了绕过护栏的方法而被限制,后来 Anthropic 与政府合作改进了安全分类器,阻断率超过 99%。6 月 30 日他们还发布了 Claude Sonnet 5,一个更强的「中型 agent 模型」,会规划、会用浏览器和终端工具、能自主跑完一段任务,现在成了 Free 和 Pro 用户的默认模型,价格定在每百万输入 token 仅 2 美元,优惠到 8 月 31 日。
Meta 这边动静也不小。7 月 12 日,他们推出瞄准 agentic coding(智能体编程)的 Muse Spark 1.1,扎克伯格在 X 上亲自宣布——这是他三年社媒沉寂之后的回归发声。Meta AI 主管 Alexandr Wang 放话,说它在 agent 任务和编程上「目前最强」,尤其擅长跨多个应用的电脑操作工作流。更早的 7 月 6 日,Meta 正式关停了 Llama API 服务——那个卖了14 个月的 API 实验正式画上句号,转向双轨:一边把开源的 Llama 交给社区,一边用闭源的 Muse 驱动 WhatsApp、Instagram 和 Facebook。他们还在训练一个更大的模型,内部代号「Watermelon」,据说关键基准已经追上 GPT-5.5。
把这几条线拼起来,你会发现一个清晰的方向:AI 的竞争已经从「谁聊天更聪明」,彻底转向「谁能让 AI 自己把活干完,而且干得便宜、干得安全、数据还留在自己手里」。微软要的是把命脉攥回自己手心,OpenAI 把推理和协作的档位拉满,Anthropic 守着安全与性价比,Meta 则在开源与闭源之间走钢丝。当四家巨头不约而同地把筹码押在「会自己干活的 AI」上时,普通用户很快就会发现,手里的工具不再只是回答问题,而是开始替你承担一整段工作——这或许才是这一周真正值得记住的信号。