商湯 日日新 6
商湯第六代原生多模態大模型家族,以統一架構實現文字、影象、影片、語音的深度推理,並延伸出 6.7 Flash-Lite 辦公智慧體與開源 U1 統一模型
深度報告
-
「商湯 日日新 6」是商湯科技(SenseTime,港交所程式碼 00020)「日日新 SenseNova」大模型體系第六代(V6)家族的統稱,並非單一固定版本。該系列於 2025 年 4 月 10 日首發,定位為原生多模態通用大模型,核心賣點是把文字、影象、影片、語音放在同一套架構裡做深度推理。截至 2026 年 7 月,這條產品線已演進到 SenseNova 6.7 Flash-Lite(2026 年 5 月)與理解生成統一的 SenseNova U1(2026 年 4 月開源)等子型號。商湯真正的差異點在於「原生多模態」與「統一架構」兩條技術路線,以及面向辦公工作流的 Token Plan 免費策略,但公司長期虧損與 C 端薄弱仍是繞不開的現實。
-
商湯科技成立於 2014 年,創始人、董事長兼 CEO 為徐立,聯合創始人、首席科學家為王曉剛。公司起家於計算機視覺(CV),曾連續十年蟬聯中國視覺 AI 市場份額第一,2021 年底登陸港交所,按收入計一度是亞洲最大的 AI 軟體公司。2022 年底 ChatGPT 引爆大模型浪潮後,商湯在 2023 年推出「日日新」大模型,試圖把視覺時代的積累遷移到通用 AI。王曉剛曾在 2025 年 2 月公開表示「日日新 6.0 將在 2025 年釋出」,後續落地的正是 V6 家族。2025 年財報顯示,商湯生成式 AI 收入 36.29 億元,同比增長 51%,佔總營收 72.4%,已成為事實上的營收支柱。
-
V6 首發時是一個超過 6000 億引數的 MoE 原生多模態通用大模型,憑單一模型即可處理文字與多模態任務。技術上靠三板斧:多模態長思維鏈(超過 200B 高質量長鏈資料,最長 64K 思維鏈)、全域性記憶(國內率先支援 10 分鐘級影片全幀率解析,10 分鐘影片可壓縮到約 16K token 保留關鍵語義)、強化學習(面向多種圖文任務的混合增強學習框架)。實測場景裡,它能讀保險理賠材料判斷是否符合要求、給《黑神話》錄屏剪高光並配解說文案、做跨頁繪本的情感化演繹。V6 同期推出的輕量全模態互動模型 SenseNova V6 Omni,是國內首個商業化的全模態實時互動模型,已在角色扮演、點讀翻譯、文旅導遊等場景落地。 到了 2026 年,家族重心轉向「辦公工作流」。SenseNova 6.7 Flash-Lite(2026 年 5 月)砍掉了視覺轉文字的中間層,讓模型直接「看懂」網頁佈局、文件結構、財務圖表,實現「看、想、做」一體化,官方稱在資訊搜尋等場景下 Token 消耗比純文字智慧體直降 60%,並在 ClawEval、MathVision 等智慧體基準取得同級別多項 SOTA。同期開源的 SenseNova U1 則走得更遠——基於自研 NEO-unify 架構,徹底移除視覺編碼器(VE)和變分自編碼器(VAE),在單一模型裡統一多模態理解、推理與生成,是業內首個實現連續性圖文創作輸出的模型,8B-MoT 輕量版在 MMMU 達 80.55、GenEval 約 0.91、中文資訊圖文字渲染 0.977,以 Apache 2.0 協議開源後 GitHub 迅速破 1500 Star。
-
商湯麵向開發者的 API 呼叫按 Token 計費,早期基礎版每 100 萬 Token 收費約 60 元,呼叫量大的客戶有折扣。2026 年推出的 SenseNova Token Plan 是更激進的商業動作:公測期間每 5 小時重新整理 1500 次免費呼叫額度、無門檻、零預充值,覆蓋 SenseNova 6.7 Flash-Lite、U1 Fast、DeepSeek V4 Flash 等模型,並可配合開源的 SenseNova-Skills 辦公技能套件使用。API 端點為 https://token.sensenova.cn/v1/chat/completions,相容 OpenAI SDK 格式,模型標識為 sensenova-6.7-flash-lite。官方同時預告後續將推出 Lite、Pro 等收費檔位。對開發者而言,這是當前少見的「逆勢免費」——在 DeepSeek、智譜等紛紛漲價的背景下,商湯選擇用免費額度換取生態與呼叫量。
-
正面反饋集中在兩點:一是原生多模態在辦公長鏈路任務上確實好用,有評測讓 6.7 Flash-Lite 處理近 90 萬行、連續三年的銷售記錄並輸出運營分析報告,模型能先做「資料審計」識別異常離群值,再給動態定價建議;二是 U1 的資訊圖與 PPT 生成質量達到商業級,文字不再扭曲亂碼,風格一致性遠超傳統多模型串聯。U1 在 HuggingFace 趨勢榜與開發者社群引發熱議,有開發者評價這是「終於有人在原生統一方向上認真做了工程落地」。負面聲音則多指向 C 端體驗——有使用者吐槽「日日新」對話在通用場景下顯得「智障」,Seko 影片生成效果不如競品,認為商湯組織基因是 To B 的,C 端產品只是「技術展示視窗」,資源投入遠低於企業服務。
-
2025 年 6 月,中國信通院完成可信 AI 多模態大模型首輪評估,商湯日日新融合模態大模型獲當前最高評級 4+ 級,是國內首家。第三方熱力榜(如大模型之家 2026 年 5 月榜)將商湯與百度、阿里、DeepSeek、智譜、MiniMax 並列,認為其「模型開源+晶片適配+API 降價」的打法推動行業從「引數內卷」走向「生態協同」。科技媒體(科技日報、雷峰網)對 U1 的 NEO-unify 架構評價較高,認為「去掉 VAE 之後用 8B 引數重新定義了開源生圖上限」,統一架構在表示、訓練穩定性與資料效率上確有收益。不過在 2026 年的旗艦對比裡,商湯 V6 的推理基準(對標 2025 年的 o1、GPT-4.5)已明顯落後於 DeepSeek V4、Qwen3.7-Max、GLM-5.1 等新一代模型,「國內第一」的說法更多是 2025 年的快照。
-
第一,命名與版本混亂。「日日新 6」只是日常簡稱,實際家族已分叉為 V6、V6 Omni、6.7 Flash-Lite、U1 等多個子型號與能力取向,普通使用者容易混淆。第二,公司財務壓力沉重。公開資料顯示,商湯 2018 年至 2025 年上半年累計虧損超過 563 億元,同期累計營收約 240 億元,相當於每賺 1 元伴隨約 2.2 元虧損;2024 年研發費用 41.32 億元甚至超過當年總營收。2025 年看似扭虧,但利潤表的改善很大程度來自出售附屬公司及金融資產(其他利得淨額 19.17 億元中超 90% 來自賣資產),AIDC 算力運營成本同比激增 163.5%。第三,市場份額被蠶食。IDC 資料顯示其中國大模型平臺份額從 2023 年的 16%(第二)下滑至 2024 年的 13.8%(第三),2025 年應用類大模型中標廠商 TOP10 中商湯未入圍。第四,技術迭代快、護城河待驗證。V6 的多模態推理優勢是 2025 年的結論,一年後被新一代旗艦反超,開源 U1 雖架構新穎但主要戰場仍在資訊圖/PPT 這類垂直辦公場景。
-
它適合兩類人:一是需要把「讀文件、做分析、出圖表、生成 PPT」串成一條自動鏈路的辦公與資料分析使用者,Token Plan 免費額度足以低成本試水;二是想在本地或自託管部署統一多模態模型的開發者,U1 的 Apache 2.0 許可與 ComfyUI 支援降低了門檻。不適合追求最強通用推理或 C 端聊天體驗的使用者——這類需求交給 DeepSeek V4、Qwen3.7-Max 或豆包更穩妥。若把商湯模型用於嚴肅生產,建議先在免費額度內跑通真實任務,再評估付費檔位的成本與穩定性。
-
商湯日日新 6 系列的真正價值不在某一次跑分,而在於「原生多模態」與「理解生成統一」兩條架構路線,以及用免費 Token Plan 撬動辦公生態的打法;但公司長期虧損、C 端薄弱與份額下滑,意味著這條技術路線能否轉化為可持續的商業閉環,仍是最大未知數。
使用者評論
-
sadwolf506—卡成 PPT 的時候也有。 -
Isabella_Powell_202032—商量 V4 的 128K 長文字處理確實讓人眼前一亮,日常讀長文件挺順手,國產大模型這進步速度挺讓人欣慰的。 -
DEgra—商湯財報看著扭虧了,但利潤一大塊來自賣資產,AIDC 算力成本還漲了 160% 多,長期能不能靠大模型自己造血、擺脫專案和融資續命,我還是打個問號。 -
Samuel_JimenezZ—說句實話,商湯 C 端一直沒做出現象級產品,「日日新」對話在通用場景還是顯得有點笨,組織基因畢竟是 To B 的,技術展示視窗的定位讓它投入遠不如企業服務,在百模大戰裡起跑就慢了半拍,這點使用者吐槽不是沒道理。 -
JMorgan_Plus6—槽點:deepseek-v4-flash 開不了思考模式,複雜推理還是得上 Pro。 -
DrDickMartinez_88—吐槽一下,sensenova-u1-fast 我這邊一直調不通,報錯說模型不可用,白高興一場。 -
翡翠853—我拿 6.7 Flash-Lite 跑了一遍連續三年、近 90 萬行銷售記錄的分析,它居然先做「資料審計」把異常離群值挑出來,判斷其中極值並非錯誤而是促銷場景,再給動態定價建議,輸出還帶折線圖和餅圖,這種長鏈路辦公閉環比只會給建議的模型實用太多了。 -
姜梅—整體來說日常夠用,寫程式碼管夠,複雜場景再上 Pro,免費的視窗期建議先鎖個賬號。 -
月光_16—NEO-unify 把 VAE 也去掉了這事挺硬核的,8B 引數就能在生圖和資訊圖上打到商業級,統一架構這條路如果真走通,意味著理解和生成不再是兩套系統在中間接力翻譯,資訊損耗會小很多,對開源多模態生態是個不小的變數。 -
TimothyCastillo—U1 生圖終於不把漢字扭成麻花了,資訊圖排版也像回事。 -
PandaPackJames—註冊頁面那個「API Key 僅顯示一次」的提示結果還能反覆檢視,有人調侃是 vibe coding 出來的,小 bug 但挺出戲的。 -
YieldFarmerFrank—商湯這波免費真香。 -
EmilyVasquez_Max4—免費額度每 5 小時 1500 次,薅就完事了。 -
Paul_Garcia_202020—Token Plan 註冊三分鐘就拿到了 Key,把 DeepSeek V4 Flash 接進 agent loop 跑瀏覽器自動化,呼叫成本直接降了一個數量級。 -
6nqerkrl—Office 小浣熊免配置直接用,適合不想折騰的人。 -
閻明—DeepSeek V4 Flash 在商湯這邊免費而且響應極快,我實測過可以穩穩跑到 140 token/s,關鍵是相容 OpenAI API 格式,把現有的 SDK 改兩行配置就能切過來,連思考鏈路一起跑瀏覽器自動化都能扛住,對不想自己部署硬體的個人開發者相當友好。 -
TylerEdwards—中文確實更省 token,1 個 token 差不多頂 1 到 1.4 個漢字,比 OpenAI 在中文語境下划算一些。 -
bigswan861—老牌大廠底子還是在的。 -
小魚_26—自定義模型訓練對小白還是有點門檻,資料標註那套得花時間慢慢摸索,普通使用者更適合直接用現成的對話和生圖。