HappyOyster 1.0

阿里云推出的一款实时交互式开放世界模型,输入一句话或一张图即可生成可探索、可互动、可实时改写的AI数字世界

In-depth Report

  • HappyOyster 1.0(快乐生蚝)是阿里巴巴 ATH(Token Hub)创新事业部推出的实时交互式开放世界模型产品,于 2026 年 7 月 19 日正式登陆阿里云百炼平台开启灰测。与传统的文生视频工具不同,HappyOyster 的核心定位是「世界模拟器」—— 用户输入一句话或一张图,即可生成可探索、可交互、可实时改写的 AI 数字世界。产品提供世界探索(Adventure)和实时导演(Directing)两大模式,支持 Android/iOS/Web 三端 SDK,目前处于免费灰测阶段。它在全球世界模型赛道中与 Google Genie 3 直接对标,属于最早一批面向大众开放体验的交互式世界模型产品。

  • HappyOyster 来自阿里巴巴旗下 ATH 创新事业部(Token Hub),该团队在视觉生成领域已有深厚积累,此前推出的视频生成模型 HappyHorse(快乐马)在 Video Arena 盲测中曾登顶榜单。ATH 团队在短短数月内连续推出 HappyHorse 和 HappyOyster 两款产品,技术迭代速度令人瞩目。 阿里云在 2026 年 3 月财报会上宣布了「五年内云+AI 收入超 1000 亿美元」的战略目标,财报数据显示阿里云 2026 财年 Q3 收入同比增长 36%,AI 相关产品收入已连续 10 个季度保持三位数增长。HappyOyster 的发布被视为阿里 AI 战略从「大模型军备赛」转向「世界模型基础设施」的关键落子。 行业层面,2026 年 4 月出现了「48 小时三大事件」—— 阿里发布 HappyOyster、腾讯同日开源混元 3D 世界模型 2.0、群核科技登陆港交所成为「全球空间智能第一股」。这一系列事件标志着世界模型赛道正从技术探索迈向商业化临界点。据钛媒体报道,截至 2026 年 4 月,全球已有至少 12 家主要玩家布局世界模型赛道,包括 Google、OpenAI、Meta、NVIDIA 等巨头。

  • HappyOyster 1.0 的核心技术路线是原生多模态加长时序建模,它与传统文生视频模型有本质区别。文生视频模型的学习目标是文本到视频的单向映射,而 HappyOyster 学习的是从「当前状态/动作」到「下一状态/动作」的转移规律,因此用户可以在任意节点介入并改变数字世界的走向。 产品提供两大核心模式: 世界探索模式(Adventure Mode):用户输入文字或上传图片即可生成可探索的数字世界。通过 WASD 按键操控角色进行前冲、下蹲、跳跃、攻击等动作,支持载具驾驶与武器战斗等物理交互。该模式支持长达 1 分钟的连续实时位移与镜头控制,生成的内容可导出原片。用户可以在第一人称和第三人称视角间切换,自由探索生成的 3D 空间。IT 之家评测提到,该模式的画面一致性在同类产品中表现突出,场景细节(如路面积水倒映路灯、阳光透过玻璃洒入室内等)符合物理规律。 实时导演模式(Directing Mode):用户获得更多的创作自由度,可以在任意节点暂停剧情,回跳至关键节点并输入新的提示词改变剧情走向。该模式支持生成 3 分钟以上的 480p 或 720p 实时画面,支持镜头调度、角色控制和剧情重写。有评测者在导演模式中输入「可爱的吉卜力风格的小猫突然跑到女孩身边」,模型无需重新渲染就直接在当前画面中生成了小猫,说明实时响应能力较强。 实际体验方面,GIGAZINE 的详细评测给出了第一手反馈:注册即可获得 1000 体验积分,每次操作消耗相应积分。生成世界大约需要 1 分钟左右,之后便可以通过 WASD 键自由操控角色。评测者指出了一些问题,包括「人物面部会随时间逐渐变化」「键盘输入的响应存在数秒延迟」「穿模现象尚未完全解决」等。但也有积极反馈,一位用户表示「在一段 HappyOyster 场景中待了 40 分钟,它不是视频模型,它是一个会回应的游戏引擎」。

  • HappyOyster 1.0 目前处于灰测免费阶段,所有用户均可免费注册体验。首次注册赠送 1000 体验积分,截至 2026 年 7 月 17 日之前每日登录还可免费领取额外积分。7 月 17 日之后的定价策略尚未正式公布。 国际版本(happyoyster.com)提供了较为明确的定价参考:免费版(Free Tier)$0,Studio 版 $29/月。但这针对的是国际早期访问版本,国内灰测的最终定价仍有待官方确认。可以预期的是,随着产品进入正式商用,阿里云可能会通过百炼平台向企业开放 API 并按用量收费,同时保留面向个人用户的免费体验额度以保持竞争力。 同类产品中,HappyHorse(视频生成模型)的定价为 720P 每秒 0.9 元、1080P 每秒 1.6 元,可作为 HappyOyster 正式定价的参考锚点。

  • 从公开的社区讨论和媒体文章中收集到的评价可以看到,用户对 HappyOyster 的体验感受分化明显。正面评价集中在实时交互的创新性、画面一致性和多模态输入的自由度上。X 平台用户 @ai_sandbox 评价说:「在一段 HappyOyster 场景中待了 40 分钟。它不是视频模型。它是一个会回应的游戏引擎。」Reddit 用户 @world_model_watch 也注意到:「重新进入昨天构建的场景后几何体完全一致,这一点被所有人低估了。」 负面反馈主要集中在几个方面。操作延迟是最普遍的问题,多位评测者都提到键盘输入和画面响应之间存在明显延迟。穿模现象也频繁出现,尤其是在角色靠近墙壁、建筑等障碍物时。人物面部稳定性不足是另一个问题,GIGAZINE 评测中发现角色的脸会随着时间推移逐渐改变。一位中文评测者在腾讯新闻上评论道:「你可以保证 15 秒内的 AI 推理画面基本稳定,再多 AI 就容易跟你胡闹了。」 总的来说,评测者对 HappyOyster 的技术方向普遍持肯定态度,认为它是当前可体验的世界模型中效果最好的一家,但同时承认产品形态仍处于早期探索阶段,距离真正的「世界模拟器」还有距离。

  • 行业媒体对 HappyOyster 的报道集中在技术路线和行业意义上。钛媒体一篇深度分析文章指出,HappyOyster 采用流式生成框架,将高维视频与多模态信息压缩为紧凑的动态 latent state,大幅降低单步生成的计算开销。文章将当前全球世界模型赛道归为三大流派:生成式视频派(以 Google Genie 3、阿里 HappyOyster、OpenAI Sora 为代表)、抽象预测派(Meta V-JEPA 2)和空间智能派(腾讯 HY-World 2.0、NVIDIA Omniverse、群核科技)。 在对比竞品方面,HappyOyster 被认为是与 Google Genie 3 最直接的对标产品。两者同属「世界模拟器」流派,但 HappyOyster 在交互时长上实现突破——探索模式支持 1 分钟、导演模式支持 3 分钟以上,而 Genie 3 的实时交互时长数据尚未公开。腾讯 HY-World 2.0 走差异化路线,选择开源并支持与 Unity 等游戏引擎无缝对接,生成的 3D 资产可直接用于二次编辑。 证券时报和财联社等财经媒体的报道则更多聚焦于商业价值层面,指出 HappyOyster 正在探索下一代多模态互动内容形态,在交互式游戏、互动短剧、虚拟陪伴和文旅等领域具备广阔的应用前景。

  • 目前 HappyOyster 面临的主要挑战是技术成熟度不足。物理一致性、响应延迟和长程稳定性仍有较大提升空间,这在一定程度上限制了其商业化落地的速度。多位行业观察者指出,世界模型「看可以看,但还不够」—— 用于概念验证和快速原型绰绰有余,但要达到生产级应用的稳定性还需要时间。 另一个潜在风险在于定价策略的不确定性。灰测期即将结束(2026 年 7 月 17 日免费活动到期),但正式定价尚未公布。如果定价过高,可能会抑制早期用户的采用热情;如果定价过低,则可能影响产品的持续研发投入。 此外,世界模型赛道目前概念火热但实际落地场景有限。钛媒体在分析报告中明确指出,HappyOyster 虽然被定位为世界模拟器,但目前的主要用户仍集中在游戏原型设计和影视预演两个方向,距离真正的「通用世界模拟器」还有相当长的路要走。 行业竞争也在加剧。除了 Google Genie 3 和腾讯 HY-World 2.0,群核科技凭借 15 年积累的空间数据集和已验证的商业闭环(2025 年营收 8.2 亿元,毛利率 82.2%,已实现盈利),在「空间智能」这一细分方向上展现出更明确的商业化路径。HappyOyster 需要尽快找到差异化的竞争优势和变现渠道。

  • HappyOyster 1.0 适合以下几类用户:游戏开发者可以通过上传场景图和角色图快速生成开放世界原型;影视创作者可以借助导演模式做预演和镜头调度;互动内容创作者可以构建可探索的沉浸式空间;对 AI 前沿技术感兴趣的科技爱好者也值得体验。 不太适合以下场景:追求稳定批量视频素材产出的团队(建议使用 Kling 或 Veo 等传统视频生成工具);需要导出可编辑 3D 模型资产的场景(建议使用腾讯 HY-World 2.0 或群核科技产品);需要高画质(1080p 以上)成品输出的用户(HappyOyster 目前最高仅支持 720p)。 使用建议方面,初学者可以从小任务开始。不要在第一次就要求它完成一部短片,而是先测试一个房间、一条街道、一个简单的镜头移动。如果能在小范围内保持稳定,再逐步扩展任务规模。

  • HappyOyster 1.0 是阿里 ATH 团队在交互式世界模型领域交出的一份阶段性答卷。作为目前少有的面向大众开放的实时交互式世界模型,它在技术方向上走在了行业前列。尽管产品形态仍处于早期探索阶段,物理一致性和交互体验还有较大提升空间,但它所代表的「从被动生成到主动模拟」的产品理念,为下一代多模态互动内容形态打开了想象空间。

User Reviews

  • 头像
    Web_3Fi
    画质确实有点糊,480p在漫游模式下勉强能看,导演模式上720p会好一些,但还远不如Sora那种电影质感。

  • 头像
    DolphinDefiMartin
    滑雪场景效果太好了!!连雪山都可以翻越,俯冲的姿态做得很细致,但动作键一次只能生效一个,不能边转弯边加速,有点捉急。

  • 头像
    Garrett27_9
    最惊艳的是导演模式,输入「男主亲了女主」,结果女主反手给了他一拳,这因果推理简直绝了,AI自己学会了戏剧冲突!

  • 头像
    MaryGomez_88
    玩了半小时,感想就是——金庸群侠传角色站在雨里发呆打不了怪,笑死我了。漫游模式能生成物理一致的空间,但做不了真正的游戏。

  • 头像
    墨染_1
    免费积分用了两天就没了,不过每天登都能领,白嫖党表示真香。

  • 头像
    Bobby_Allen_99
    操作延迟真的挺明显的,特别是漫游模式跑动的时候,按了W得等一两秒画面才反应,晕3D的慎入。

  • 头像
    ja3drg
    上传梵高星空的图片,真的能走进画里去,自动配的BGM也很搭,但因为没有路,视角一直在撞房子,又好笑又好气。

  • 头像
    Sandra_CampbellX
    把原神角色塞进赛博朋克2077的场景里毫无违和感,人物和场景解耦这个设计太赞了,想怎么跨就怎么跨。

  • 头像
    CharlesGutierrez_88712
    和Google Genie 3比,生蚝的交互时长确实更长,导演模式能跑3分钟,Genie据说到30秒就开始穿模了,但画质还是Genie好一点。

  • 头像
    SarahHoward_2023
    最让我惊喜的是画面一致性,转身回头之前看到的房子和树都还在原地,不会像其他AI那样飘来飘去。

  • 头像
    BWrightSr
    我用它做了一个侦探雨夜找线索的场景,中途输入「出现一只猫」,结果人和猫时不时合成在一起,很AI很抽象哈哈哈。

  • 头像
    zrky36
    给角色放三视图就不会崩了,这算是个小技巧,游戏团队拿来快速出原型确实好用。

  • 头像
    JeanCampbell_99
    音画协同做得比预期好,脚步声和环境音是同步生成的,不用后期配音,这点省了不少事。

  • 头像
    yellowbear178
    导演模式下的Dramatic档位太疯了吧,我输入鲨鱼,结果画面里全是鲨鱼,后面鲨鱼脸都撕裂了还往我嘴里冲,什么恐怖片现场。

  • 头像
    Linda_Brown_Pro
    总体来说值得一试,毕竟免费,但目前还属于「看可以看,但还不够」的阶段,期待后续迭代。

  • 头像
    书生_23
    人物面部随时间推移会慢慢变化,同一个角色前10秒和后30秒长得不太一样,这点比较出戏。

  • 头像
    TokenLrnk
    穿模问题还是有的,特别是靠近墙壁的时候直接穿过去,不过目前市面上的世界模型都逃不过这个问题。

  • 头像
    Adam_Walker369
    导演模式输入「镜头拉远展示海面」,它真的做到了!然后切换到甲板第一人称视角也能实现,就是过一会儿会复位,有点莫名其妙。

  • 头像
    Joshua.PerezX
    作为一名游戏开发者,一张概念图丢进去就能跑出可玩的场景,这个原型效率太香了,以前一周的活现在一天搞定。

  • 头像
    Gabriel_Gray007
    漫游模式只有一分钟,刚找到感觉就结束了,希望能延长时长,三分钟不过分吧。

  • 头像
    ypwjalfugp
    期待API开放,如果能通过百炼调接口,我们就可以自己做二次开发了,想象空间很大。

  • 头像
    MadisonCollins_77
    第一次在HappyOyster场景里待了40分钟,它不是视频模型,它是一个会回应的游戏引擎,这种体验之前没有过。

  • 头像
    Laura.Butler369
    赛博朋克城市街道测试,输入指令加霓虹灯,模型不是简单用滤镜敷衍了事,而是重新校准了色调和材质反射,说明它真的理解了赛博朋克是什么。

  • 头像
    Jose_GonzalesII
    重新进入昨天构建的场景后几何体完全一致,这一点被所有人低估了,这是一个真正的3D世界而不是一段视频。

  • 头像
    PenguinPool545
    阿里ATH团队连续出HappyHorse和HappyOyster两个爆款,视觉生成确实有两把刷子,期待后续更多产品。