Google Gemini 4 Ultra

Google DeepMind 於 2026 年 5 月釋出的第四代旗艦多模態大模型,支援千萬級 Token 上下文、原生多模態生成與 Agentic 自主工作流,搭載第七代 Ironwood TPU

深度報告

  • Google Gemini 4 Ultra 是 Google DeepMind 於 2026 年 5 月 19 日在 Google I/O 大會上釋出的第四代旗艦級多模態大模型。作為 Gemini 系列的巔峰之作,Gemini 4 Ultra 以「Agentic-first」為設計理念,在上下文長度、多模態生成能力、自主推理與跨應用任務執行等方面實現了全面飛躍,被視為 Google 從「AI 助手」邁向「AI 作業系統」的核心引擎。

  • Gemini 4 Ultra 最大的突破來自其上下文視窗——最高支援 1000 萬 Token(實際訂閱版本提供 200 萬 Token),是前代 Gemini 2.5 Pro 的 10 倍,也是當時業界最大的上下文視窗之一。這意味著它可以在單次推理中處理整部小說的全文、數小時的影片/音訊轉錄、或者整個程式碼倉庫的架構分析。 對於研究人員而言,可以直接將數百篇論文一次性喂入模型做綜合分析與交叉引用;對於開發者而言,可以在一個會話中理解整個專案的業務邏輯與呼叫鏈路。

  • 在基準測試方面,Gemini 4 Ultra 在 ARC-AGI2(抽象推理挑戰)上取得了約 84.6% 的成績,顯著超越 GPT-5.5(約 7x%)和 Gemini 2.5 Pro(約 52%),展現出在全新約束條件下推理能力的質的提升。MMLU 得分 92.5,長文字檢索精度(Needle In A Haystack)高達 95.2%,均處於當時第一梯隊。

  • Gemini 4 Ultra 採用了稀疏 MoE(Mixture of Experts)架構,並引入了 Google 稱為「知識啟用門」的創新——模型會先判斷使用者的問題是否需要呼叫外部或本地知識庫,再決定啟用多少個 MoE 專家。據 Google 官方資料,相比 2.0 Ultra,相同算力下呼叫外部知識時的響應速度提升了 47%,準確率提升了 12%。

  • 該模型是原生多模態設計,不僅支援文字、影象、音訊的輸入和輸出,還首次在高保真度上支援影片生成(基於 Veo 3 模型)、音樂生成和空間感知輸出(適配 AR/機器人)。Gemini 4 Ultra 的影片生成能力可在 30 秒內生成高畫質連貫短片,內建故事板功能,允許使用者逐幀控制創作過程。

  • Gemini 4 Ultra 搭載在 Google 第七代 TPU——Ironwood(TPU v7)上執行。Ironwood 的峰值效能約為 TPU v5p 的 10 倍,單晶片推理/訓練效能相比 Trillium(TPU v6)提升 4 倍。這種硬體層面的深度協同,使得 Gemini 4 Ultra 即使在處理千萬級 Token 上下文的極端場景下仍能保持可控的推理延遲。

  • 從產品矩陣來看,Gemini 4 系列分為四個層次:Gemini 4 Nano(端側核心,INT4 量化後記憶體佔用低於 600MB,延遲低至 35ms,適配 Android 17 裝置離線執行);Gemini 4 Flash(邊緣伺服器設計,低延遲最佳化);Gemini 4 Pro(均衡型,支援 128K Token 上下文,面向通用場景);以及 Gemini 4 Ultra(旗艦級,面向極致效能需求)。

  • Gemini 4 Ultra 所驅動的應用場景覆蓋了 Google 的整個產品生態。在 Gemini 應用中,它作為預設模型提供服務;在 Google 搜尋的 AI Mode 中,它提供多步推理和引用了來源的會話式答案;在 Android 17 的 Gemini Intelligence 系統級 AI 層中,它驅動跨應用的自主工作流(如「從 Gmail 中找到我的課程大綱,識別教材,加入購物車」這樣的單一指令即可完成多步操作);在 Android XR 智慧眼鏡上,它提供實時翻譯、視覺理解和導航能力。 Gemini 4 Ultra 還引入了「Gemini Spark」智慧體平臺。Spark 是一個跨應用全自動任務智慧體,能夠從 Gmail 獲取資訊、操作購物車、完成下單等操作,無需使用者手動指令。這是 Google 將 AI 從「被動應答」轉向「主動執行」的關鍵一步。

  • 訂閱方案方面,Google 提供了分層定價:免費版受限於標準額度,上下文 32K Token;Google One AI Premium($19.99/月)提供 1M 上下文、4x 額度、Gmail/Drive/Docs 等 Workspace 整合,附贈 2TB 儲存;Google AI Ultra($99.99/月)提供 5x 額度、Deep Think 推理模式、Gemini Spark 智慧體、YouTube Premium 等權益。此外,針對專業使用者還有更高階的 Gemini Ultra 訂閱($249/月,2M 上下文、Veo 3 無限影片生成、30TB 儲存)。 Gemini 4 Ultra 帶來了 AI 能力在多個維度上的顯著提升,但也存在值得關注的侷限。首先是定價——最高檔訂閱 $249/月對於個人使用者來說門檻較高,主要面向企業、研究機構和重度創作者。其次,在純程式碼開發場景中,部分評測指出 Claude Max 和 GPT-5.5 在特定編碼基準(SWE-Bench)上仍有優勢。此外,千萬級 Token 上下文的實際應用場景仍相對有限,對大多數使用者而言 1M-2M Token 已綽綽有餘。Gemini 4 Ultra 的釋出也引發了關於 AI 能力邊界與安全治理的新一輪討論,Google 同步公佈了 Safety Core 框架以應對模型能力躍升帶來的潛在風險。

使用者評論

  • 頭像
    逍遙_10
    剛升級了 Gemini 4 Ultra,200萬上下文真的太誇張了,直接把整個專案程式碼庫扔進去,它居然能跨檔案分析依賴關係。

  • 頭像
    SatoshiSnakeJones
    Deep Think 模式確實強,但一次對話直接燒掉我 40% 的配額,肉疼。日常用 Pro 就夠了,Ultra 適合真要啃硬骨頭的時候。

  • 頭像
    Cynthia.Morgan_7
    用了 Ultra 兩週,最深的感覺就是:Google 生態整合是真香。在 Gmail 裡直接讓它總結郵件、在 Docs 裡改文件、在 Sheets 裡寫公式,完全不用切視窗。如果你本來就生活在 Google 全家桶裡,這個訂閱價效比確實高。

  • 頭像
    IRodriguez_20244
    我專門試了一下它處理超大文件的能力,把一本 400 頁的電子書扔進去讓它做章節摘要,12 秒出結果,每個章節的關鍵論點都抓得很準。以前用其他模型分章節處理至少得來回切十幾次上下文,現在一次搞定,效率提升不是一點點。

  • 頭像
    DennisMartin_Plus
    吐個槽:Gemini Ultra 的 Deep Research 跑出來的報告有時會漏引用來源,核查起來反而更費時間。功能是好功能,但「可驗證性」還得加強。

  • 頭像
    Kathryn.Wilson_2022
    Gemini 4 Ultra 的影片生成比想象中好,30 秒生成了一個產品宣傳短片,連貫性不錯,但細節經不起放大看。商用還得再迭代幾版。

  • 頭像
    Cynthia_RichardsonSr
    把 Gemini 4 Ultra 接入了我司的客服系統,上下文理解能力比之前用的模型強很多,能記住使用者前面提過的需求,不用每次都重新說。

  • 頭像
    TOrtizK
    Ironwood TPU 加持下的推理速度確實快,處理 100 頁 PDF 基本是秒級響應。但說實話,大部分場景我用 32K 上下文的免費版也夠了。

  • 頭像
    CRuizSr
    我是做科研的,經常需要同時讀十幾篇論文做交叉分析。Ultra 的 200 萬上下文對我來說是剛需,以前要花一整天的事現在一小時搞定。

  • 頭像
    BeverlyThompson_Plus
    Gemini Spark 智慧體試了一下,讓它「從 Gmail 找到上週的報價單,提取價格,做成表格發給我」,居然真的跑通了。雖然中間卡了一次,但方向是對的,期待後續最佳化。

  • 頭像
    Douglas_Coleman_2020
    純程式碼場景我覺得 Claude 還是強一點,Ultra 寫 Python 還行,但寫 TypeScript 的時候偶爾會腦補不存在的 API。不過如果是做 Google Cloud 相關的開發,Ultra 對 GCP 生態的理解明顯更深,算是有舍有得吧。

  • 頭像
    Christina_Simmons168
    SEA 地區使用者表示,最近 Ultra 的響應延遲明顯變高了,不知道是海底電纜問題還是伺服器負載問題。凌晨用倒挺快。

  • 頭像
    SLewis
    知識啟用門這個設計挺聰明的,簡單問題不調大模型,省算力又快。DeepMind 在工程最佳化上確實有一套。

  • 頭像
    RClarkQ1
    把一份 200 頁的招股書扔進去,讓它找出所有風險披露條款並對比往年變化,五分鐘出結果。這要是人工做至少一整天。$20 月費光這一單就回本了。

  • 頭像
    Jerry_BellIII
    Android 17 上的 Gemini Intelligence 確實好用,長按電源鍵直接說「幫我訂下週五去上海的火車票」,它自己開啟 12306、選車次、填資訊,就差最後一步付款了。這種跨應用的 Agent 能力,確實讓手機從一個被動工具變成了主動助手。

  • 頭像
    IRISnetProHall007
    今天用 Gemini 4 Ultra 做了一個競品分析報告,從網上抓了 5 家競品的公開資訊,加上我自己的產品文件,它自動生成了一個帶對比表格的完整報告。最驚豔的是它還能自己配圖,Imagen Ultra 4 生成的對比圖直接可以用在 PPT 裡。雖然有些資料需要人工核實,但整體質量已經能省掉 80% 的案頭工作了。

  • 頭像
    onnxcu
    Gemini Code Executor 2.0 支援跨語言協作編輯挺驚豔的,我一個 Python 指令碼寫到一半讓它在裡面跑 SQL 查詢,結果直接出表。

  • 頭像
    5vjig78g1
    Imagen Ultra 4 生成的圖片真的比 Midjourney 還真實,尤其是人像,皮膚質感和光影處理太自然了。商用素材可以直接用。

  • 頭像
    LawrenceVasquez_66
    個人感覺 Ultra 的中文能力比 GPT-5.5 好,寫中文文案的時候用詞自然很多,不會那種翻譯腔。

  • 頭像
    MsEeviTuomala_x
    試了一下 Gemini 4 Ultra 的音訊理解能力,把一段 2 小時的會議錄音扔進去,它自動生成了會議紀要和待辦事項,發言人都能區分,牛。

  • 頭像
    Zachary_Allen
    ARC-AGI2 84.6% 確實厲害,但日常使用中感知不強。絕大多數使用者的問題根本到不了需要這種抽象推理的級別。

  • 頭像
    珊瑚611
    升級到 Ultra 之後最大的變化其實是配額焦慮減輕了,不用再精打細算每次對話用了多少額度。5x 額度夠我隨便造。