巨頭親手改寫AI版圖

一週三樁大事重塑行業

2026-07-20 18:13

「AI Agent」這個詞近兩年被炒得很熱,但你不用管那些術語,把它想成一個「能自己定計劃、自己拿工具幹活的數字員工」就好。過去的聊天機器人,你問一句它答一句,多走一步就要你下指令;而 agentic(也就是「有行動力的智慧體」)不一樣,你給個目標,它會自己拆解步驟、開啟瀏覽器查資料、在終端敲命令、甚至反覆試錯直到把活兒幹完。理解了這一點,你才能看懂這一週科技圈到底發生了什麼——幾家巨頭同時出手,爭的不是「誰的模型聊天更順」,而是「誰的 AI 能真正替人把事辦了」。

先說微軟。這家把 Office 賣到全世界桌子上的公司,最近悄悄邁出了「去 OpenAI 化」的第一步。在 Excel 和 Outlook 裡,微軟開始用自研的 MAI 模型家族,替換掉原本來自 OpenAI 與 Anthropic 的第三方模型。新模型 MAI-Thinking 1 在編碼能力上,已經追平了 Anthropic 的 Claude Opus 4.8——這是彭博社援引內部測試的說法。每週,這兩款旗艦辦公軟體已經有數萬條 AI 提示請求,完全由微軟自家模型在背後處理。

你可能會問:微軟不是 OpenAI 最大的金主和合作伙伴嗎,為什麼要換?根子上是兩筆賬。第一是成本,呼叫別人家高價 API 就像租算力過日子,用得越多越肉疼;第二是資料主權,也就是「資料駐留」——企業客戶尤其是歐洲和受監管行業,強烈要求資料留在自家地盤、別往外送。微軟 AI 部門掌門人 Mustafa Suleyman 正牽頭把對高價第三方介面的依賴降下來。目前 MAI 的整體佔比還很小,但它更像是插進 Copilot、Azure AI 和整個 Microsoft 365 生態的一塊「灘頭堡」,先把位置佔住。

再看 OpenAI 這邊。7 月 9 日,GPT-5.6 系列正式公開,一口氣放出 Sol、Terra、Luna 三個模型,覆蓋 ChatGPT、Codex 程式設計工具和對外 API。旗艦 Sol 最值得說——它新增了兩檔「加力」能力。所謂 max,相當於給模型多分配一些推理時間,讓它把替代方案都探索一遍、自己糾錯,類似考試時允許你多想幾分鐘再交卷;所謂 ultra,則是協調四個並行 agent 例項去啃那種又複雜又多步驟的硬骨頭,代價是 token 消耗更高、更費錢。Terra 是均衡的日常選手,Luna 則主打最快最省。再往前一天,7 月 8 日他們還推出了 GPT-Live 新一代語音模型,原生實時架構,能打斷、能暫停理解、能實時翻譯和聽寫,背後編排著 GPT-5.5,而每週用 ChatGPT Voice 的人已經超過1.5 億

Anthropic 的故事則像一部被按下暫停鍵又重啟的劇。7 月 1 日,在 6 月 12 日美國出口管制解除之後,Claude Fable 5 恢復了訪問——它之前因為 Amazon 的研究者發現了繞過護欄的方法而被限制,後來 Anthropic 與政府合作改進了安全分類器,阻斷率超過 99%。6 月 30 日他們還發布了 Claude Sonnet 5,一個更強的「中型 agent 模型」,會規劃、會用瀏覽器和終端工具、能自主跑完一段任務,現在成了 Free 和 Pro 使用者的預設模型,價格定在每百萬輸入 token 僅 2 美元,優惠到 8 月 31 日。

Meta 這邊動靜也不小。7 月 12 日,他們推出瞄準 agentic coding(智慧體程式設計)的 Muse Spark 1.1,扎克伯格在 X 上親自宣佈——這是他三年社媒沉寂之後的迴歸發聲。Meta AI 主管 Alexandr Wang 放話,說它在 agent 任務和程式設計上「目前最強」,尤其擅長跨多個應用的電腦操作工作流。更早的 7 月 6 日,Meta 正式關停了 Llama API 服務——那個賣了14 個月的 API 實驗正式畫上句號,轉向雙軌:一邊把開源的 Llama 交給社群,一邊用閉源的 Muse 驅動 WhatsApp、Instagram 和 Facebook。他們還在訓練一個更大的模型,內部代號「Watermelon」,據說關鍵基準已經追上 GPT-5.5。

把這幾條線拼起來,你會發現一個清晰的方向:AI 的競爭已經從「誰聊天更聰明」,徹底轉向「誰能讓 AI 自己把活幹完,而且幹得便宜、幹得安全、資料還留在自己手裡」。微軟要的是把命脈攥回自己手心,OpenAI 把推理和協作的檔位拉滿,Anthropic 守著安全與價效比,Meta 則在開源與閉源之間走鋼絲。當四家巨頭不約而同地把籌碼押在「會自己幹活的 AI」上時,普通使用者很快就會發現,手裡的工具不再只是回答問題,而是開始替你承擔一整段工作——這或許才是這一週真正值得記住的訊號。