昆仑万维 Skywork 3
昆仑万维天工 3.1 一体化 AI 智能体,用可视化画布与多 Agent 并行工作流把复杂任务从 Demo 推进到可交付产品
深度报告
-
昆仑万维在 2026 年 6 月 17 日同步海内外上线天工(Skywork)3.1 大模型,核心新增两项能力:承载可视化设计的 Skywork Design 画布,以及调度多智能体并行的 Dynamic Workflows。在 3.0 版本已验证商业化之后,3.1 明确把天工从「对话式生成工具」推向「生产级工作流平台」。 需要说明:daily 速递中的「Skywork 3」并非官方单一代际命名,昆仑万维当前的公开主线产品是天工 3.1 及背后的 Skywork 系列模型(含 SkyClaw-v1.0 Agent 模型、开源多模态推理模型 Skywork-R1V 3.0 等)。本报告以可验证的最新一代——天工 3.1 为基准撰写,命名口径差异留人工审核。
-
昆仑万维(300418.SZ)是 2023 年起「All in AGI 与 AIGC」的国内先行者,已搭建「算力—大模型—应用」全链条。其天工系列模型多次登顶开源 SOTA,海外收入占比升至 91%(昆仑万维官方介绍)。集团旗下还有 AI 短剧平台 SkyReels、短剧平台 DramaWave、AI 音乐平台 Mureka、AI 社交应用 Linky 等应用矩阵。 天工 3.0 于 5 月上线后,超级智能体业务收入环比增长两倍(中证报);到 3.1 发布,昆仑万维称已进入「需求调研—界面设计—批量作业—网页部署—文档输出」的全闭环 AI 工作链路。
-
Skywork Design 把 AI 设计工作从对话框搬到可无限延展的可视化画布,覆盖官网整站搭建、App 原型、文档转 UI、参考图复刻四大商用场景,并支持上传品牌素材后由 Agent 固化设计规范,让几十轮迭代后视觉仍统一(中证报、搜狐)。 Dynamic Workflows 则把大型任务自动拆解,并行调度数十到上百个子智能体,分执行与复核两类、交叉核验结果,并支持断点续跑;典型场景如软件公司 200+ 页面 UI 一夜改版、全站文案一次性改版(雪球、三文阁)。两大能力打通账号体系、知识库与会员权益,形成从调研到交付的闭环。底层由 5 月发布的 SkyClaw-v1.0 支撑:支持百万 token 上下文,Agent 基准超越 Minimax 2.7、DeepSeek V4 Flash,接近 Claude Opus 4.6(IT之家)。
-
面向 C 端,天工基础功能免费开放;SkyClaw-v1.0 开放 2 至 4 周免费试用(IT之家)。官网 skywork.ai 以「$1 七天试用」引流,试用期内每日免费积分由 120 升至 800,并解锁 SkyClaw、无限下载与 AI 图像分析编辑(官网)。 SkyClaw API 定价为输入 0.5 元/百万 Token、输出 4 元/百万 Token,约为同类顶尖模型的一半(三文阁)。商业抓手是「规模化复杂任务的性价比」:3.0 上线一个月收入三倍增长,深度用户单项目平均交互超 40 轮、远超行业平均 3 轮(今日头条、中证报)。
-
正面反馈集中在「从 Demo 到产品」的落地感:有用户实测「对话框是草稿纸,画布才是工作台」,用画布从零搭出含首页、作品分类、联系页的插画师官网并同步适配 PC 与移动端(三文阁)。一键 PPT、多文档交叉分析、AI 音乐生成等被高频使用。 负面与保留意见在于:画布功能刚上线、部分细节仍在打磨,复杂任务的端到端成功率据第三方评测约 85%,并非百分百稳定(ainews.cool);试用结束后付费门槛,以及海外版与国内版(tiangong.cn)的功能与定价差异,也让部分用户观望。
-
媒体普遍认为 3.1 是一次范式变化:交互从「线性对话」走向「可视化空间协作」,智能体从「单兵」进化为「多 Agent 军团」,AI 真正承接完整商业订单而非碎片小样(雪球、今日头条)。天工超级智能体此前登顶 GAIA 评测,开源侧 Skywork-R1V 3.0 在 MMMU 取得 76.0 的开源最高分、超过 Claude-3.7-Sonnet 与 GPT-4.5,逼近人类初级专家水平(智东西、财联社)。 在通用大模型红海中,天工避开「流量入口」消耗战,切入企业「规模化交付 + 极致性价比」的刚需(今日头条)。
-
其一,命名与版本口径混乱:daily 称「Skywork 3」,但官方对外是 3.0→3.1 的连续迭代,开源线另有 R1V 3.0、SkyClaw-v1.0,普通用户容易混淆。其二,公司财务压力明显:2026 年一季度营收 25.70 亿元(同比 +45.69%),但归母净利润 -8.87 亿元、扣非 -8.91 亿元,同比继续下滑,投资收益与公允价值变动拖累利润(中国基金报、公司一季报)。 其三,多 Agent 并行的「交叉核验」能缓解幻觉,但端到端复杂任务仍有约 15% 失败率,关键业务落地需人工兜底。其四,海外收入占比高(91%),地缘与合规波动对商业化影响较大。
-
适合创业者、自由职业者快速搭官网与作品集;产品经理出 App 原型;运营与市场批量产活动页、海报、PPT;设计师用 AI 出初稿再进 Figma 深化;程序员把全站迭代、代码审计交给多 Agent。 不适合需要 100% 稳定输出、对合规与数据主权要求极高的关键系统;也不适合只想「聊聊天」的轻量用户——它卖的是劳动力外包,不是聊天入口。若追求纯文本推理,可关注其开源的 Skywork-OR1、R1V 系列。
-
天工 3.1 把 AI 从「我问一句它答一句」推进到「我给目标它跑完整个项目」,用半价 Agent 军团把过去几周的活压缩到几天。它的天花板不在技术能否打,而在复杂任务场景的付费意愿与市场规模;命名口径与持续亏损,是落地之外最该盯住的两点。
用户评论
-
JeanRamosZ—整体是我今年用过最顺手的 AI 生产力工具,适合把想法直接变成能交付的东西,推荐试试。 -
lazypeacock182—断点续跑这个功能救过我,批量任务跑到一半断了,重新跑不用从头来,省时间。 -
ROrtiz_Max—R1V 3.0 多模态推理 MMMU 76 分开源第一,超过 Claude 3.7 和 GPT-4.5,开源党狂喜。 -
JRussellZ337—比起卷聊天入口,昆仑万维选了规模化交付这条务实的路,反而差异化出来了。 -
PaulJones007—试用七天一块钱挺划算,但试用完付费档位有点犹豫,观望一下再决定。 -
Janet.Sanders369—做独立插画师作品集官网那篇实操我照着做了一遍,首页+作品分类+联系页,PC 和移动端都适配好了,真能交付。 -
SReyesZ—命名有点乱,daily 写 Skywork 3,官方又叫 3.1,开源那边还有 R1V、SkyClaw,新人容易搞混。 -
Samuel.Clark_Pro—多文档交叉分析挺快,五份行业报告丢进去,一分钟出带原文定位的对比,做行研省事。 -
Timothy.Roberts520055—「对话框是草稿纸,画布才是工作台」这句话说到点子上了。 -
杜涛—昆仑万维一季度又亏八个多亿,营收涨了但利润没跟上,靠这个 Agent 商业化能不能扭转还得看。 -
MrEzraBrown_dev—端到端复杂任务成功率大概八成五,剩下的还得自己兜底,关键业务别完全放手。 -
JudeCruz—AI 音乐生成也不错,写短视频配乐不用下 DAW,直接拖进剪映就能用。 -
NicoleButler_2021—国内版 tiangong.cn 和海外版 skywork.ai 功能不太一样,第一次用有点懵,建议统一下入口说明。 -
DrEllaKivela—一键 PPT 真好用,丢个会议纪要加报表,自动出二十多页带配图的,省了我大半天的活。 -
SPort—深度用户单项目平均交互 40 轮,行业才 3 轮,这数据说明真有人把它当生产工具用。我自己的项目也是改了三十多轮才定稿,这种强依赖一旦形成,替换成本就很高了。 -
BananaBucksReyes—画布功能还是有点糙,复杂布局偶尔会抽风,比如多栏瀑布流切到移动端会错位,希望后续打磨。但整体方向我认可,至少不像某些产品只会出 demo,真到交付环节就掉链子。 -
EWoodIII—定价挺实在,API 输入 0.5 输出 4,差不多是顶尖模型一半。我们做批量内容生成,原来一个月光推理费就上万,切到 SkyClaw 之后成本直接砍半,这种性价比对小团队太重要了。 -
ETm_en—我们小团队用 Dynamic Workflows 一夜把 200 多页后台 UI 改了版,以前这种活设计师排期至少一周。这次派了上百个子 Agent 并行处理不同模块,还有专门的复核 Agent 拦错误,第二天直接交付开发,错误率明显比人工低。 -
DeborahCampbell—免费试了 SkyClaw,百万上下文确实香。我直接丢一整个代码库让它做安全排查,它把可疑函数和硬编码密钥都列出来了,比我自己翻快了不止一个量级,关键是跨文件的调用链它也能串起来。 -
ANgom_s—天工 3.1 这个画布思路是对的。以前用别的 AI 做官网,生成一张漂亮图就完了,客户一问其他页面、手机端适配就露馅。现在画布能保留迭代记录,改主色全站跟着变,这才是生产工具该有的样子。