商汤 日日新 6

商汤第六代原生多模态大模型家族,以统一架构实现文本、图像、视频、语音的深度推理,并延伸出 6.7 Flash-Lite 办公智能体与开源 U1 统一模型

深度报告

  • 「商汤 日日新 6」是商汤科技(SenseTime,港交所代码 00020)「日日新 SenseNova」大模型体系第六代(V6)家族的统称,并非单一固定版本。该系列于 2025 年 4 月 10 日首发,定位为原生多模态通用大模型,核心卖点是把文本、图像、视频、语音放在同一套架构里做深度推理。截至 2026 年 7 月,这条产品线已演进到 SenseNova 6.7 Flash-Lite(2026 年 5 月)与理解生成统一的 SenseNova U1(2026 年 4 月开源)等子型号。商汤真正的差异点在于「原生多模态」与「统一架构」两条技术路线,以及面向办公工作流的 Token Plan 免费策略,但公司长期亏损与 C 端薄弱仍是绕不开的现实。

  • 商汤科技成立于 2014 年,创始人、董事长兼 CEO 为徐立,联合创始人、首席科学家为王晓刚。公司起家于计算机视觉(CV),曾连续十年蝉联中国视觉 AI 市场份额第一,2021 年底登陆港交所,按收入计一度是亚洲最大的 AI 软件公司。2022 年底 ChatGPT 引爆大模型浪潮后,商汤在 2023 年推出「日日新」大模型,试图把视觉时代的积累迁移到通用 AI。王晓刚曾在 2025 年 2 月公开表示「日日新 6.0 将在 2025 年发布」,后续落地的正是 V6 家族。2025 年财报显示,商汤生成式 AI 收入 36.29 亿元,同比增长 51%,占总营收 72.4%,已成为事实上的营收支柱。

  • V6 首发时是一个超过 6000 亿参数的 MoE 原生多模态通用大模型,凭单一模型即可处理文本与多模态任务。技术上靠三板斧:多模态长思维链(超过 200B 高质量长链数据,最长 64K 思维链)、全局记忆(国内率先支持 10 分钟级视频全帧率解析,10 分钟视频可压缩到约 16K token 保留关键语义)、强化学习(面向多种图文任务的混合增强学习框架)。实测场景里,它能读保险理赔材料判断是否符合要求、给《黑神话》录屏剪高光并配解说文案、做跨页绘本的情感化演绎。V6 同期推出的轻量全模态交互模型 SenseNova V6 Omni,是国内首个商业化的全模态实时交互模型,已在角色扮演、点读翻译、文旅导游等场景落地。 到了 2026 年,家族重心转向「办公工作流」。SenseNova 6.7 Flash-Lite(2026 年 5 月)砍掉了视觉转文本的中间层,让模型直接「看懂」网页布局、文档结构、财务图表,实现「看、想、做」一体化,官方称在信息搜索等场景下 Token 消耗比纯文本智能体直降 60%,并在 ClawEval、MathVision 等智能体基准取得同级别多项 SOTA。同期开源的 SenseNova U1 则走得更远——基于自研 NEO-unify 架构,彻底移除视觉编码器(VE)和变分自编码器(VAE),在单一模型里统一多模态理解、推理与生成,是业内首个实现连续性图文创作输出的模型,8B-MoT 轻量版在 MMMU 达 80.55、GenEval 约 0.91、中文信息图文字渲染 0.977,以 Apache 2.0 协议开源后 GitHub 迅速破 1500 Star。

  • 商汤面向开发者的 API 调用按 Token 计费,早期基础版每 100 万 Token 收费约 60 元,调用量大的客户有折扣。2026 年推出的 SenseNova Token Plan 是更激进的商业动作:公测期间每 5 小时刷新 1500 次免费调用额度、无门槛、零预充值,覆盖 SenseNova 6.7 Flash-Lite、U1 Fast、DeepSeek V4 Flash 等模型,并可配合开源的 SenseNova-Skills 办公技能套件使用。API 端点为 https://token.sensenova.cn/v1/chat/completions,兼容 OpenAI SDK 格式,模型标识为 sensenova-6.7-flash-lite。官方同时预告后续将推出 Lite、Pro 等收费档位。对开发者而言,这是当前少见的「逆势免费」——在 DeepSeek、智谱等纷纷涨价的背景下,商汤选择用免费额度换取生态与调用量。

  • 正面反馈集中在两点:一是原生多模态在办公长链路任务上确实好用,有评测让 6.7 Flash-Lite 处理近 90 万行、连续三年的销售记录并输出运营分析报告,模型能先做「数据审计」识别异常离群值,再给动态定价建议;二是 U1 的信息图与 PPT 生成质量达到商业级,文字不再扭曲乱码,风格一致性远超传统多模型串联。U1 在 HuggingFace 趋势榜与开发者社区引发热议,有开发者评价这是「终于有人在原生统一方向上认真做了工程落地」。负面声音则多指向 C 端体验——有用户吐槽「日日新」对话在通用场景下显得「智障」,Seko 视频生成效果不如竞品,认为商汤组织基因是 To B 的,C 端产品只是「技术展示窗口」,资源投入远低于企业服务。

  • 2025 年 6 月,中国信通院完成可信 AI 多模态大模型首轮评估,商汤日日新融合模态大模型获当前最高评级 4+ 级,是国内首家。第三方热力榜(如大模型之家 2026 年 5 月榜)将商汤与百度、阿里、DeepSeek、智谱、MiniMax 并列,认为其「模型开源+芯片适配+API 降价」的打法推动行业从「参数内卷」走向「生态协同」。科技媒体(科技日报、雷峰网)对 U1 的 NEO-unify 架构评价较高,认为「去掉 VAE 之后用 8B 参数重新定义了开源生图上限」,统一架构在表示、训练稳定性与数据效率上确有收益。不过在 2026 年的旗舰对比里,商汤 V6 的推理基准(对标 2025 年的 o1、GPT-4.5)已明显落后于 DeepSeek V4、Qwen3.7-Max、GLM-5.1 等新一代模型,「国内第一」的说法更多是 2025 年的快照。

  • 第一,命名与版本混乱。「日日新 6」只是日常简称,实际家族已分叉为 V6、V6 Omni、6.7 Flash-Lite、U1 等多个子型号与能力取向,普通用户容易混淆。第二,公司财务压力沉重。公开资料显示,商汤 2018 年至 2025 年上半年累计亏损超过 563 亿元,同期累计营收约 240 亿元,相当于每赚 1 元伴随约 2.2 元亏损;2024 年研发费用 41.32 亿元甚至超过当年总营收。2025 年看似扭亏,但利润表的改善很大程度来自出售附属公司及金融资产(其他利得净额 19.17 亿元中超 90% 来自卖资产),AIDC 算力运营成本同比激增 163.5%。第三,市场份额被蚕食。IDC 数据显示其中国大模型平台份额从 2023 年的 16%(第二)下滑至 2024 年的 13.8%(第三),2025 年应用类大模型中标厂商 TOP10 中商汤未入围。第四,技术迭代快、护城河待验证。V6 的多模态推理优势是 2025 年的结论,一年后被新一代旗舰反超,开源 U1 虽架构新颖但主要战场仍在信息图/PPT 这类垂直办公场景。

  • 它适合两类人:一是需要把「读文档、做分析、出图表、生成 PPT」串成一条自动链路的办公与数据分析用户,Token Plan 免费额度足以低成本试水;二是想在本地或自托管部署统一多模态模型的开发者,U1 的 Apache 2.0 许可与 ComfyUI 支持降低了门槛。不适合追求最强通用推理或 C 端聊天体验的用户——这类需求交给 DeepSeek V4、Qwen3.7-Max 或豆包更稳妥。若把商汤模型用于严肃生产,建议先在免费额度内跑通真实任务,再评估付费档位的成本与稳定性。

  • 商汤日日新 6 系列的真正价值不在某一次跑分,而在于「原生多模态」与「理解生成统一」两条架构路线,以及用免费 Token Plan 撬动办公生态的打法;但公司长期亏损、C 端薄弱与份额下滑,意味着这条技术路线能否转化为可持续的商业闭环,仍是最大未知数。

用户评论

  • 头像
    sadwolf506
    卡成 PPT 的时候也有。

  • 头像
    Isabella_Powell_202032
    商量 V4 的 128K 长文本处理确实让人眼前一亮,日常读长文档挺顺手,国产大模型这进步速度挺让人欣慰的。

  • 头像
    DEgra
    商汤财报看着扭亏了,但利润一大块来自卖资产,AIDC 算力成本还涨了 160% 多,长期能不能靠大模型自己造血、摆脱项目和融资续命,我还是打个问号。

  • 头像
    Samuel_JimenezZ
    说句实话,商汤 C 端一直没做出现象级产品,「日日新」对话在通用场景还是显得有点笨,组织基因毕竟是 To B 的,技术展示窗口的定位让它投入远不如企业服务,在百模大战里起跑就慢了半拍,这点用户吐槽不是没道理。

  • 头像
    JMorgan_Plus6
    槽点:deepseek-v4-flash 开不了思考模式,复杂推理还是得上 Pro。

  • 头像
    DrDickMartinez_88
    吐槽一下,sensenova-u1-fast 我这边一直调不通,报错说模型不可用,白高兴一场。

  • 头像
    翡翠853
    我拿 6.7 Flash-Lite 跑了一遍连续三年、近 90 万行销售记录的分析,它居然先做「数据审计」把异常离群值挑出来,判断其中极值并非错误而是促销场景,再给动态定价建议,输出还带折线图和饼图,这种长链路办公闭环比只会给建议的模型实用太多了。

  • 头像
    姜梅
    整体来说日常够用,写代码管够,复杂场景再上 Pro,免费的窗口期建议先锁个账号。

  • 头像
    月光_16
    NEO-unify 把 VAE 也去掉了这事挺硬核的,8B 参数就能在生图和信息图上打到商业级,统一架构这条路如果真走通,意味着理解和生成不再是两套系统在中间接力翻译,信息损耗会小很多,对开源多模态生态是个不小的变量。

  • 头像
    TimothyCastillo
    U1 生图终于不把汉字扭成麻花了,信息图排版也像回事。

  • 头像
    PandaPackJames
    注册页面那个「API Key 仅显示一次」的提示结果还能反复查看,有人调侃是 vibe coding 出来的,小 bug 但挺出戏的。

  • 头像
    YieldFarmerFrank
    商汤这波免费真香。

  • 头像
    EmilyVasquez_Max4
    免费额度每 5 小时 1500 次,薅就完事了。

  • 头像
    Paul_Garcia_202020
    Token Plan 注册三分钟就拿到了 Key,把 DeepSeek V4 Flash 接进 agent loop 跑浏览器自动化,调用成本直接降了一个数量级。

  • 头像
    6nqerkrl
    Office 小浣熊免配置直接用,适合不想折腾的人。

  • 头像
    阎明
    DeepSeek V4 Flash 在商汤这边免费而且响应极快,我实测过可以稳稳跑到 140 token/s,关键是兼容 OpenAI API 格式,把现有的 SDK 改两行配置就能切过来,连思考链路一起跑浏览器自动化都能扛住,对不想自己部署硬件的个人开发者相当友好。

  • 头像
    TylerEdwards
    中文确实更省 token,1 个 token 差不多顶 1 到 1.4 个汉字,比 OpenAI 在中文语境下划算一些。

  • 头像
    bigswan861
    老牌大厂底子还是在的。

  • 头像
    小鱼_26
    自定义模型训练对小白还是有点门槛,数据标注那套得花时间慢慢摸索,普通用户更适合直接用现成的对话和生图。