国产大模型,集体拐弯
从玩具到工具
国产大模型这几天像是约好了似的,集体往前冲了一大步。7月20日,从 DeepSeek 到阿里、商汤、面壁智能,一连串重磅消息几乎在同一天砸向市场。对普通用户来说,这意味着好用的 AI 越来越便宜、也越来越「能干活」了,但背后其实藏着一条更清晰的线索——中国大模型正集体走到「能力」与「商业化」同时拐弯的路口。
先说最受关注的 DeepSeek。多方消息称,DeepSeek V4 正式版已经开启灰度测试,最快当天就会发布。所谓灰度测试,就是先放一小批用户试用、边跑边调,没大毛病再全面放开。开发者实测下来,它的整体水平已经接近海外顶尖模型 Claude Opus 4.8,写代码的能力更是直追 GPT-5.6,连做 Agent 自动任务和生成 3D、SVG 图都比上一代强了一大截。
这次 V4 最大的变化,是第一次给模型装上了「计价器」——峰谷计费。这词听着陌生,道理却很日常:就像用电,半夜平峰便宜、傍晚高峰贵;也像打车,平时一个价、早晚高峰加价。V4 Pro 每百万输出 Token 在平峰只要 0.87 美元,到了高峰涨到 1.74 美元,对比一下更吓人,隔壁 Fable 5 要价 50 美元,DeepSeek 还是低了一个数量级。难怪有人调侃,这是「价格屠夫第一次给自己装了电表」。
阿里这边也没闲着。千问 Qwen3.8 即将发布并开源,参数规模达到 2.4 万亿,预览版已经悄悄上线到阿里自家的 Token 计划和开发者平台供人体验。开源这两个字对普通人意味着:这套模型的代码和权重是公开免费的,谁都能拿去改、拿去搭自己的应用,不必被某一家公司卡脖子。资本市场立刻给了反应——受这个消息提振,阿里港股当天涨了 3.73%。
商汤在 WAIC 世界人工智能大会上甩出的 SenseNova U1 Pro,走的则是另一条路——「交付级」的多模态模型。多模态简单说就是模型能同时看懂文字、图片、视频,不再只会打字聊天。「长程任务 Agent」更像一个能自己干一整件事的助手:它支持原生 8K 输出,还能连续做几十轮自主生成循环,一次性吐出 22 个逻辑连贯的视频分镜,等于帮导演把分镜头脚本一口气铺好了。预览版已经邀请测试,正式版预计 8 月上线。
面壁智能把目光投向了机器人。它开源了只有 15 亿参数的 MiniCPM-Robot 系列具身智能模型,所谓「具身」,就是让 AI 真正长在机器身体里、能动手操作物体。这个系列在 LIBERO 等评测里挤进第一梯队,单帧推理延迟大约 120ms,差不多是同类顶尖模型的一半,而且支持断网在本地跑,不依赖云端。他们还顺手开源了配套的具身推理框架 PhyAI。
把视野拉宽一点,这一周还有个耐人寻味的注脚。Kimi K3 带着 2.8 万亿参数上线,前端代码能力登顶全球第一,结果上线三天就撞上算力天花板,月之暗面不得不暂停 C 端新用户订阅、全速扩容。这说明国产模型「能力够不够」和「算力撑不撑得住、怎么收钱才划算」这两件事,正同步逼到临界点。
热闹归热闹,真正值得普通人记住的只有一句话:当各家开始比谁更便宜、谁更能交付完整结果,AI 才算真正从「玩具」变成了「工具」。这一周的密集突破未必个个都能落地,但它清清楚楚标出了一个方向——国产大模型的下半场,拼的不再是参数有多大,而是谁先让普通人用得起、用得顺。