Meta Muse Image

Meta 超級智慧實驗室首款自研影象生成模型,以智慧體式工作流嵌入 Instagram 與 WhatsApp

深度報告

  • Meta Muse Image 是 Meta 超級智慧實驗室(Meta Superintelligence Labs)於 2026 年 7 月 7 日推出的首款自研影象生成模型,由從 Scale AI 加盟的 Alexandr Wang 團隊主導。它最大的不同在於「智慧體式影象生成」:模型會主動搜尋網路、呼叫程式碼、自我修正,而不是傳統的一句提示詞出一張圖。在 Arena 人類偏好榜單上,它在文生圖、單圖編輯、多圖編輯三項均排第二,僅次於 OpenAI 的 GPT Image 2。它的真正護城河不是模型質量,而是 Meta 把生成能力直接嵌進了 Instagram、WhatsApp 和 Meta AI 這些幾十億人每天開啟的 App。

  • Muse Image 是 Meta 擺脫第三方影象模型依賴的關鍵一步。過去幾年,Meta 先後用過自家的 Emu,也授權過 Midjourney 等外部模型。2026 年 4 月,Meta 先發布了文字與推理模型 Muse Spark,取代 Llama 家族成為內部文字底座;Muse Image 則是同一實驗室在視覺方向上的第一炮,內部代號「Mango」。釋出背景也耐人尋味:2026 年 7 月初,扎克伯格對內坦言 AI 智慧體進展「不如預期」,Muse 算是一次面向消費者的可見回擊——直接落到 Instagram,而不是遲遲交付的底層智慧體基礎設施。Meta 同時把 2026 年資本開支預期上調到 1250 億至 1450 億美元,主要為支撐這類模型的資料中心成本。

  • Muse Image 把影象生成從「輸入提示詞—輸出圖片」的單輪模式,推進到「智慧體式」工作流。它會先思考請求,遇到需要事實支撐的內容(如新聞事件、真實地點)會主動聯網搜尋,用相關視覺參考提升準確性;涉及圖表、二維碼這類需要精確幾何或文字的結果時,它會寫程式碼並執行程式再生成;生成之後還會自我檢查,區域性細節錯了就改圖,方向不對就重生成,事實缺失就再搜尋。Meta 稱這種自我修正能力是強化訓練裡自然湧現的,因為「不斷最佳化結果」能拿到更高獎勵。 它還能與 Muse Spark 協同:Spark 負責規劃佈局、從網路抓取實時上下文、融合多個視覺參考,從而處理「把寵物放進畫作」「結合自拍和度假照」這類複雜請求。在 Instagram 裡,Muse Image 提供了 30 種新的 AI 快拍特效;也支援房間重設計(可結合網路或 Facebook Marketplace 的商品按指定風格改造空間)、老照片修復、換髮型、消除照片里路過的路人、以及生成可用的功能性二維碼。使用者可以直接在圖上圈選或塗鴉來標註要修改的區域,對話上下文保留,能不重啟流程地繼續調整。 一個被外界反覆提及的亮點是「用 Instagram 賬號當提示詞」:在 Meta AI 的提示裡 @ 一個公開賬號,模型就會用該賬號公開照片的視覺風格來生成新圖。The Verge 把這句話概括為「Meta 的新 Muse Image 模型能把別的 Instagram 使用者拉進 AI 照片裡」——把過去一年「風格參考」「角色一致性」的研究,第一次以零門檻 @ 真人公開賬號的方式做成了產品。不過這個功能在釋出約一週後(7 月 14 日前後)被 Meta 撤回,理由是收到反饋。

  • Muse Image 的日常創作在 Meta AI App(meta.ai)、美國區 Instagram 快拍、部分國家的 WhatsApp 裡免費使用,Facebook 支援「即將上線」。超過某個未公開的使用上限後,需要訂閱 Meta 的付費計劃(該計劃於 2026 年 5 月推出,具體價格和免費額度 Meta 尚未公佈)。對商家側,Meta 表示未來幾週會透過 Advantage+ creative 向廣告主和代理商開放,讓廣告素材的變體生成、跨版位適配、本地化測試更快——這才是這次消費級釋出裡藏著的變現故事。2026 年一季度,Meta 家族應用的廣告展示量同比漲 19%,平均單價漲 12%,Muse 嵌入 Advantage+ 後有望進一步放大這一引擎。

  • 體驗呈現明顯兩極。有使用者讓模型生成「1988 年喬丹扣籃的黏土動畫 + 拆解工程分析圖」,無需額外除錯就直接輸出了完整成品,稱讚其開箱即用的能力;也有使用者把 Gemini、Grok、Meta AI 三款模型用相同提示詞對比,整體認為 Meta 的圖在社交場景語境上更貼。負面反饋同樣直接:有使用者讓模型畫內耳解剖圖,結果結構出錯,質疑它在專業領域的可靠性;還有使用者認為它的繪圖能力並沒有宣傳的那麼強。總體上,使用者認可它在「適配 Instagram 等社交場景、圖片編輯和生成效果不錯」,但對專業精度和「有時翻車」有保留。

  • 在 Arena.ai 基於真實使用者投票的榜單上,截至 2026 年 7 月 5 日,Muse Image 在文生圖(Elo 1280,GPT Image 2 為 1385)、單圖編輯、多圖編輯三項均列第二,壓過 Google 的 Nano Banana 2(1270)和 MAI Image 2.5(1257)。行業普遍把它解讀為 Meta 切斷對第三方影象模型依賴的訊號:自研意味著更快迭代、更緊整合,以及對廣告工具更強的掌控。多數分析認為,Meta 的優勢不在模型本身,而在分發——沒有一個對手的影象模型能像 Muse 這樣直接長進 35.6 億日活的家族應用裡。與之配套的 Muse Video 也已預覽,基於同一預訓練底座、支援原生音訊,在文生影片榜單排第三,但音畫同步和快速運動的物理準確性仍待打磨,所以只是預覽而非正式釋出。

  • 最尖銳的爭議來自「@ 公開賬號生成圖」功能:預設開啟、需主動在設定裡關閉、被引用者不會收到通知、已生成的圖也不會追溯刪除。在沒有明確授權的情況下,把真實使用者的形象用於 AI 生成,被多方視為肖像權、隱私洩露和深度偽造的風險雷區,也把功能直接擺到了本就盯了 Meta 資料實踐多年的歐洲隱私監管者面前。Meta 為此提供了 Content Seal 隱形水印(官方稱抗裁剪、抗壓縮、抗縮放、抗截圖),並放出了檢測工具,在 Adobe Firefly 預設 C2PA、蘋果和 Google 也在上 C2PA 的當下,這屬於「必須接」而不是加分項。此外,Muse Image 閉源、暫無權重與公開 API(Muse Spark 的開發者 API 也已推遲),想走「被開發者微調」路線的玩家可以不用等了。

  • 創作者最適合先試:快速出社交變體圖、做安全的二創、想 story 點子、做縮圖和活動物料,但一定要先檢查自己 Instagram 的 AI 引用開關。小商家可以用它測門店概念、房間改造、產品場景樣圖、季節帖和快速投放視覺,在投入精修製作前先跑幾版。廣告主應關注 Advantage+ creative 的落地——機會是變體測試更便宜,風險是自動化可能在品牌標準之外漂移。AI 開發者值得研究它的「智慧體式」正規化:搜尋、寫程式碼、自我精修、多參考合成、分發原生,正在成為模型的新預期。不建議對專業精度(如醫學、工程圖示)有硬性要求的人依賴它,也不要在未經授權的情況下拿他人公開照片做生成。

  • Muse Image 是一次嚴肅的釋出,因為它把一線模型質量和 Meta 最強的分發網路綁在了一起:模型負責生成圖,產品負責把圖變成帖子、特效、聊天、商業概念和廣告變體。真正要觀察的是它出了釋出演示之後到底多好用、使用者能否清楚理解 Instagram 引用開關、Content Seal 在真實分享的髒環境裡是否夠穩,以及 Advantage+ 裡的廣告主使用會造出更好的 campaign 還是隻是更多自動化噪音。

使用者評論

  • 頭像
    GEjam
    免費的,先用著。

  • 頭像
    Douglas.Brooks007720
    廣告主這邊值得關注 Advantage+ creative 的落地,素材變體生成會更快,但自動化跑偏出品牌調性的風險也更大,人還是得在迴路裡。

  • 頭像
    NormanMeyer99
    日常創作免費,超過上限才要訂閱,具體價格還沒公佈,先用免費的額度試試水。

  • 頭像
    Carolyn655
    Muse Video 啥時候正式出?等影片版。

  • 頭像
    KAric
    別被「Agentic Image Generation」這個標籤帶偏了。它舉的例子——二維碼、分形海報、Flipbook 小動畫、客廳改 Japandi 風格——本質都是「程式碼 + 影象」的組合,對需要精確幾何、文字、可互動結果的場景確實有效,但對一般創意插畫其實沒本質差別。它強在工具呼叫和自我修正,不是什麼 AGI 影像。

  • 頭像
    NathanPatel
    隱私這塊是真的讓人不舒服。沒有明確的授權機制,就能把真實使用者的形象拿去生成 AI 圖,等於把肖像權和深度偽造的風險直接甩給使用者自己承擔。歐洲那邊監管本來就盯著 Meta 的資料做法,這個功能遲早要被問。好訊息是 7 月 14 號前後他們自己撤回了這個 @ 公開賬號的功能。

  • 頭像
    Thomas_HarrisIII5
    Content Seal 水印抗截圖抗壓縮,這點挺有必要。

  • 頭像
    Donna_Lewis007
    聽說那個 @ 別人公開賬號生成圖的功能被撤了,其實早該收,拿別人照片做 AI 圖連通知都不發,確實踩線。

  • 頭像
    姜心桂
    Arena 上排第二,文生圖單圖多圖編輯都壓過 Nano Banana 2,但跟 GPT Image 2 還差一截,算第一梯隊守門員吧。

  • 頭像
    MasonRobertsK
    「@ 公開賬號把別人照片拉進 AI 圖」這個預設開啟也太離譜了,被引用的人收不到通知,關掉還要去設定裡翻,明顯是 opt-out 而不是 opt-in。

  • 頭像
    梅花677
    房間重設計挺好玩,上傳照片就能看不同風格。

  • 頭像
    w1tavzmseu
    閉源沒 API,開發者先別等了。

  • 頭像
    DylanHart_66
    讓它畫內耳解剖圖,結構明顯畫錯了,專業領域還是別太指望它,當娛樂和社交出圖工具沒問題。

  • 頭像
    Michael_Mendoza_7
    功能性二維碼這個挺實用,能做活動邀請函還能把連結藏進圖裡,小商家應該會喜歡。

  • 頭像
    Lauren.GarciaQ
    前兩天拿 Muse Image 生成「1988 年喬丹扣籃的黏土動畫 + 拆解工程分析圖」,本來以為要反覆調提示詞,結果幾乎沒怎麼改就直接出了完整成品,連工程拆解的標註都像模像樣。對普通使用者來說這種開箱即用真的很加分,不用懂提示詞工程也能出東西。

  • 頭像
    trueYolandaOrtega_x
    比想象中好用,社交場景確實貼。

  • 頭像
    Edward.Hicks_88
    我用完全相同的一組提示詞分別測了 Gemini、Grok 和 Meta AI 三家的影象生成,整體感覺 Muse 在 Instagram 這種社交語境下明顯更對味——人物膚色、場景氛圍和「隨手發朋友圈」的輕鬆感都更自然。尤其是把自拍和度假照合成一張、或者做活動邀請函這類需求,Meta 比另外兩家更懂社交平臺的用法。

  • 頭像
    DianaAndersonZ304
    在 WhatsApp 裡直接讓 Meta AI 畫圖還挺順手的。