國產大模型,集體拐彎
從玩具到工具
國產大模型這幾天像是約好了似的,集體往前衝了一大步。7月20日,從 DeepSeek 到阿里、商湯、面壁智慧,一連串重磅訊息幾乎在同一天砸向市場。對普通使用者來說,這意味著好用的 AI 越來越便宜、也越來越「能幹活」了,但背後其實藏著一條更清晰的線索——中國大模型正集體走到「能力」與「商業化」同時拐彎的路口。
先說最受關注的 DeepSeek。多方訊息稱,DeepSeek V4 正式版已經開啟灰度測試,最快當天就會發布。所謂灰度測試,就是先放一小批使用者試用、邊跑邊調,沒大毛病再全面放開。開發者實測下來,它的整體水平已經接近海外頂尖模型 Claude Opus 4.8,寫程式碼的能力更是直追 GPT-5.6,連做 Agent 自動任務和生成 3D、SVG 圖都比上一代強了一大截。
這次 V4 最大的變化,是第一次給模型裝上了「計價器」——峰谷計費。這詞聽著陌生,道理卻很日常:就像用電,半夜平峰便宜、傍晚高峰貴;也像打車,平時一個價、早晚高峰加價。V4 Pro 每百萬輸出 Token 在平峰只要 0.87 美元,到了高峰漲到 1.74 美元,對比一下更嚇人,隔壁 Fable 5 要價 50 美元,DeepSeek 還是低了一個數量級。難怪有人調侃,這是「價格屠夫第一次給自己裝了電錶」。
阿里這邊也沒閒著。千問 Qwen3.8 即將釋出並開源,引數規模達到 2.4 萬億,預覽版已經悄悄上線到阿里自家的 Token 計劃和開發者平臺供人體驗。開源這兩個字對普通人意味著:這套模型的程式碼和權重是公開免費的,誰都能拿去改、拿去搭自己的應用,不必被某一家公司卡脖子。資本市場立刻給了反應——受這個訊息提振,阿里港股當天漲了 3.73%。
商湯在 WAIC 世界人工智慧大會上甩出的 SenseNova U1 Pro,走的則是另一條路——「交付級」的多模態模型。多模態簡單說就是模型能同時看懂文字、圖片、影片,不再只會打字聊天。「長程任務 Agent」更像一個能自己幹一整件事的助手:它支援原生 8K 輸出,還能連續做幾十輪自主生成迴圈,一次性吐出 22 個邏輯連貫的影片分鏡,等於幫導演把分鏡頭指令碼一口氣鋪好了。預覽版已經邀請測試,正式版預計 8 月上線。
面壁智慧把目光投向了機器人。它開源了只有 15 億引數的 MiniCPM-Robot 系列具身智慧模型,所謂「具身」,就是讓 AI 真正長在機器身體裡、能動手操作物體。這個系列在 LIBERO 等評測裡擠進第一梯隊,單幀推理延遲大約 120ms,差不多是同類頂尖模型的一半,而且支援斷網在本地跑,不依賴雲端。他們還順手開源了配套的具身推理框架 PhyAI。
把視野拉寬一點,這一週還有個耐人尋味的註腳。Kimi K3 帶著 2.8 萬億引數上線,前端程式碼能力登頂全球第一,結果上線三天就撞上算力天花板,月之暗面不得不暫停 C 端新使用者訂閱、全速擴容。這說明國產模型「能力夠不夠」和「算力撐不撐得住、怎麼收錢才划算」這兩件事,正同步逼到臨界點。
熱鬧歸熱鬧,真正值得普通人記住的只有一句話:當各家開始比誰更便宜、誰更能交付完整結果,AI 才算真正從「玩具」變成了「工具」。這一週的密集突破未必個個都能落地,但它清清楚楚標出了一個方向——國產大模型的下半場,拼的不再是引數有多大,而是誰先讓普通人用得起、用得順。