智象未來 vivago R1

全球首個無限時長內容創作多模態智慧體,支援從敘事構思到成片分發的全鏈路自動化

深度報告

  • 2026 年 7 月 20 日,智象未來(HiDream.ai)在世界人工智慧大會 WAIC 上釋出了全球首個無限時長內容創作多模態智慧體 vivago R1。這款產品徹底改寫了 AI 影片生成行業「15 秒短鏡頭」的固有模式,採用多智慧體協作架構實現從敘事構思到成片分發的全鏈路自動化。公司三個月內連續完成三輪融資、累計超 21 億元,社保基金等國家級資本領投,估值已躋身獨角獸行列。HiDream-O1-Image-1.5 模型在 Artificial Analysis 評測中以 1265 ELO 位列全球第二、國內第一。

  • 智象未來(HiDream.ai)成立於 2023 年 3 月,總部位於合肥高新區,是視覺多模態基礎模型研發與應用領域的生成式 AI 企業。創始人梅濤博士是中國科學技術大學自動化系博士、加拿大工程院外籍院士,曾在微軟亞洲研究院擔任資深研究員長達 12 年,後出任京東集團副總裁、負責京東 AI 研究院與多媒體實驗室。 公司的技術路線從創立之初就選擇了一條「硬骨頭」——原生全模態架構 UiT(Unified Transformer),摒棄傳統的「文字編碼器+VAE+擴散模型」模組化路徑,將影象畫素、文字 Token、影片體素等原始訊號對映進同一個共享 Token 空間,由一套統一的 Transformer 完成理解、生成和推理。 2026 年是智象未來的爆發之年。短短三個月內,公司連續完成三輪融資:4 月超 5 億元(東方富海、安徽省投資集團等領投),5 月新一輪注資(深創投、金浦投資等),7 月 C 輪 15 億元由社保基金四川振興科創基金、工銀資本等聯合領投,累計超 21 億元,投資方覆蓋國家隊、地方國資、影視產業資本與頂級財務機構。這輪融資陣容之「豪華」在 AI 大模型公司中極為罕見。

  • vivago R1 的核心理念可以用一句話概括:它不是一個「提示詞進、影片出」的黑盒,而是一個能像導演一樣思考的多模態智慧體。使用者只需上傳幾張照片加上簡短文字描述,就能生成分鐘級連續敘事長影片。 三層多智慧體架構 vivago R1 的設計核心是分層記憶與多 Agent 協作架構。最上層是排程層(Orchestrator),像一位總導演,只沉澱最終定稿——角色設定、敘事主線、已確認的決策,過濾掉過程噪聲。中間是專家層(Specialist Agents),駐守著編劇 Agent、導演 Agent、設計師 Agent、剪輯師 Agent,各自擁有獨立記憶,負責各自專業環節。最下面是執行層(Execution Agents),負責分段併發生成,每個子 Agent 只處理一段任務,用完即走;某一段失敗只重試該段,不影響整體進度。 梅濤將這套機制的執行邏輯概括為「記憶逐層變輕,定稿逐層上浮」——非常貼合真實創作者的直覺。 SkillHub 創作方法庫 vivago R1 把創作方法做成了產品。Skill 不再是單純的功能按鈕,而是將指令碼拆解、鏡頭組織、素材繼承、風格控制等專業流程壓縮成使用者可直接呼叫的「方法」。使用者只需知道自己要做產品廣告、故事短片還是品牌內容,Skill 負責將目標翻譯成 Agent 可以執行的「工作協議」。截至目前,SkillHub 已沉澱數百個經過真實專案驗證的創作 Skill,覆蓋跨境電商素材、影視分鏡、劇情號運營等場景。 雙檢視互動 產品同時提供 Chat 和畫布兩個檢視。Chat 是任務推進檢視,負責承接使用者意圖,是使用者與 Agent 持續協作的「時間軸」;畫布是專案上下文檢視,將創作過程中的關鍵內容重新組織為可瀏覽、可複用的結果空間。影片完成後還可直接繫結 TikTok、YouTube 等海外賬號一鍵分發。 實測表現 據鈦媒體實測,輸入指令「創作一段 1 分鐘連續敘事生活短片,主題是普通人平凡的一日」,系統自動呼叫多鏡頭敘事流程,將完整故事拆分為多個場景,啟動多 Agent 分工。生成結果展現出極佳的角色一致性——無論在自然光、室內冷光還是夜晚路燈下,人物面部特徵、髮型和體態始終保持高度統一,畫面質感達到電影級水準,光影過渡自然,動作連貫無卡頓。

  • vivago 採用「免費試用 + 階梯付費」模式。海外版定價:免費版(每日免費積分,5 秒影片含水印)、基礎版($7.9/月,1000 積分,無水印)、增強版($19.9/月,3800 積分,4K 畫質)、專業版($59.9/月,12000 積分,AI Chat Agent)。國內版價格更親民,個人付費版 29 元/月、企業版 299 元/月。 智象未來構建了「1+1+3」商業模式:1 個 HiDream-O1 系列大模型底座 + 1 個 Token Hub 平臺 + 3 大場景(商業營銷、影視創作、內容創作)。公司產品已覆蓋全球 100 多個國家和地區的 5000 多萬使用者及超過 4 萬家企業客戶。

  • 海外內容創作者對 vivago 給予了積極反饋。2026 年 5 月灰度版在 Product Hunt 登頂日榜第一。專業評測中,鈦媒體給出了 90 分的評價。使用者普遍認可其長影片一致性表現,特別是角色穩定性和畫面質感遠超同類產品。 負面反饋主要集中在:免費版水印明顯、積分制下高階功能使用成本較高、生成長影片仍需等待較長時間、以及部分複雜場景下角色一致性仍有偶發問題。 國內使用者的評價中,其無需特殊網路即可訪問、支援手機號/微信註冊、中文介面和客服等特點獲得較高滿意度。

  • 多位行業觀察者認為,vivago R1 標誌著 AI 影片生成從「單點工具」到「全鏈路創作系統」的正規化轉移。其底層 UiT 原生全模態架構被視為通往世界模型的關鍵路徑。 在技術層面,HiDream-O1-Image-1.5 在 Artificial Analysis 文生圖榜單上的表現(1265 ELO,全球第二,超過 Google Nano Banana 2、NVIDIA Cosmos3 和位元組跳動 Seedream 4.0)奠定了智象在視覺生成領域的第一梯隊地位。 從資本端看,社保基金的入局被解讀為國家級耐心資本對原生全模態世界模型方向的重要佈局。影視產業資本(華策影視、上影新視野基金、湖北長江電影集團)的聯合出現則顯示了 AI 與影視產業深度融合的趨勢。

  • AI 影片生成領域仍面臨版權歸屬爭議。雖然智象明確使用者對生成內容擁有完整版權,但訓練資料的合規性和潛在侵權風險仍是行業性難題。此外,AI 生成影片的「深度偽造」風險也需持續關注——無限時長的高質量 AI 影片若被用於虛假資訊傳播,可能帶來社會風險。 從市場競爭看,OpenAI 的 Sora、Google 的 Veo、位元組跳動的即夢等競品持續發力,智象未來能否保持先發優勢仍待觀察。模型研發的高昂成本(三個月消化 21 億融資)也對商業化節奏提出了更高要求。

  • vivago R1 最適合以下人群:需要高頻產出短影片內容的社媒創作者、缺乏專業影片製作團隊的電商商家、需要快速製作品牌宣傳素材的中小企業。不太適合對單鏡頭有精準控制需求的專業影視製作人(他們可能需要 Pika 等更細粒度控制工具)。 對於國內使用者,建議從免費版入手體驗,確認適合後再升級付費版。企業使用者可直接選擇企業版或定製版以獲取 4K 畫質和版權證明。

  • vivago R1 是 2026 年 AI 影片生成領域最具突破性的產品之一。它以多智慧體協作為核心的架構創新,成功將 AI 影片從「素材生成器」升維為「創作Agent」,讓普通使用者也能一鍵完成從前需要專業團隊才能實現的長影片創作。隨著 UiT 原生全模態架構持續迭代,智象未來正沿著「影象→影片→空間→動作→世界模型」的路徑,向更廣闊的 AI 基礎設施方向邁進。對於內容創作者和商業使用者而言,現在正是上車的最佳時機。

使用者評論

  • 頭像
    Web3DevLarsen
    作為一個跨境電商賣家,我現在每天用vivago批次生成產品展示影片。它的SkillHub裡的電商模板特別好用,選好品類後系統自動匹配視覺風格和影片節奏,生成的影片完播率比我自己剪的高了將近30%。唯一的問題是免費版每天積分不夠用,但我已升級Pro了,算下來比自己招剪輯師便宜太多了。

  • 頭像
    Patrick.RiveraQ
    昨天用 vivago R1 做了個1分鐘的劇情短片,真的不用學任何剪輯軟體,輸入一段話它就自動幫你拆分成好幾個鏡頭。最讓我驚訝的是角色從頭到尾都沒變臉,之前用其他AI影片工具最煩的就是換臉問題。

  • 頭像
    Jerry_PetersonIII
    剛升級了Pro版臺服會員,59.9刀一個月說實話有點肉疼,但生成長影片的質量確實比其他工具好太多了。做跨境電商的素材以前要外包給後期團隊,現在自己一個人就能搞定。

  • 頭像
    i6prb
    我在一個小型廣告公司做創意總監,上個月開始團隊全面用vivago R1出短影片素材。說實話一開始我是牴觸的,覺得AI做的東西沒有靈魂。但用了兩週之後我完全改觀了——不是AI做得好,而是客戶不在乎。客戶只看兩件事:能不能準時交付和畫面夠不夠吸引人。以前一個brief下來我們要兩三天出demo,現在半天就能給客戶看初版,客戶確認後直接批次出片。這已經不是好不好用的問題了,而是整個行業的遊戲規則被改變了。

  • 頭像
    ScottScott
    太強了!!直接繫結TikTok一鍵分發是我最看重的功能。以前做一條短影片要匯出→上傳→調引數→寫標題→釋出,現在一個平臺全搞定,效率翻倍。

  • 頭像
    菊花_18
    免費版積分太少,宣傳片中能自由編輯倒是好用,就是積分制不夠透明,都打水印有點煩人,再觀望一段時間。

  • 頭像
    馮貞軒
    試了一下免費的每天可以生成幾次,5秒影片帶水印,當個嚐鮮體驗還行。但真要商用還是得付費版,這價格對個人創作者來說門檻還是有點高啊。

  • 頭像
    Nancy_GarciaX
    我是做影視後期的,說實話vivago R1生成的效果確實驚豔,但離專業製作還有距離。不過對於短影片創作者和省錢的中小商家來說絕對夠用了。

  • 頭像
    Denise_Ramos_99
    等了這麼久終於釋出了!WAIC上看到演示的時候就被震撼到了,這就是我一直想要的AI影片工具,不再是15秒片段而是真正有敘事的長影片。

  • 頭像
    smallgoose248
    WAIC上看了vivago R1的現場演示,真的被震撼到了。它把整個影片創作流程從構思、分鏡、素材生成到成片輸出全部自動化了。以前做一個3分鐘的劇情短片,至少需要一個編劇、一個導演、一個剪輯師配合好幾天才能完成。現在一個人一臺電腦,輸入一段描述就能搞定。這不是效率提升,這是生產關係的變化。

  • 頭像
    joKOC
    作為短影片運營我直接無腦衝了。日更3條的壓力真的大,vivago能幫我批次出素材,角色一致性好這個點太關鍵了,以前用Stable Diffusion生成的角色每張圖都像換了一個人,根本沒法用於品牌內容。這次看到R1的演示,角色在多個鏡頭和不同光線環境下都能保持統一,我終於可以放心用AI做品牌影片了。我算了一下,每個月花60刀省了一個剪輯師的工資,這個ROI怎麼算都划算。

  • 頭像
    ERussellII
    用了兩週vivago,感覺這玩意兒就是TikTok賣貨的神器。上傳幾張產品圖,寫一段描述,自動幫你生成帶貨影片,連話術都配好了。

  • 頭像
    蝴蝶505
    中文渲染比Sora和Runway好太多了。我之前用英文工具生成中文字幕,十個字裡有八個是錯的。vivago R1至少中文能看得懂。

  • 頭像
    SIcoo
    我研究了一下它的技術架構,底層用的是自研的UiT原生全模態架構,把文字、影象、影片、音訊都放在同一個空間裡處理,不需要像傳統方案那樣在多個模型之間來回翻譯資訊。這就是為什麼它能保持角色一致性那麼好的根本原因。雖然不太懂技術細節,但從生成效果來看這條路確實走對了。

  • 頭像
    TEgon
    聽說公司三個月融了21個億,資方還有社保基金和工銀資本,這種國家隊背景至少不用擔心跑路問題了。融了這麼多錢應該能支撐很長時間的研發,不像有些AI公司融完A輪就撐不住了。而且從他們的技術路線來看,UiT原生全模態這個方向確實比市面上其他方案靠譜,希望他們能堅持走下去。

  • 頭像
    RitaPrice
    寫了個指令碼讓它生成一個3分鐘短劇,竟然一遍就過了,角色沒崩、場景切換流暢、配樂也都卡在節奏上。這種「一遍過」的體驗在其他AI影片工具上從來沒遇到過,我真的枯了。

  • 頭像
    JessicaCook_2024
    測試了Hidream的影象編輯功能,區域性修改的一致性確實比同期的其他工具好。不過修改後畫質會有輕微損失,大概壓縮了15%的樣子,希望後續能最佳化。

  • 頭像
    Doris.BrownZ
    我覺得vivago R1最大的價值不是生成影片本身,而是它把整個創作流程串起來了。從構思到分鏡到成片到分發,一個平臺搞定,這才是真正的生產力工具。

  • 頭像
    CodyMartinez
    上週用vivago給一個美妝客戶做了一批TikTok素材,客戶要求出20條不同角度的產品展示影片。我用vivago的批次生成功能,上傳了產品相簿和賣點文案,系統自動拆分成不同的指令碼和鏡頭組合,半天就出了初版。客戶對角色一致性和畫面質感都很滿意,說比他們之前找的MCN機構做得好。這個工具對中小代理公司來說真的是降維打擊。

  • 頭像
    KAram
    用vivago做了個品牌宣傳片,3分鐘時長,客戶反饋說畫面質感出乎意料的好。以前這種專案至少要花一兩萬找團隊拍,現在自己用AI幾分鐘就能出個初版。

  • 頭像
    賈博萱
    生成速度有點慢,做3分鐘影片要等5到10分鐘。不過想想以前一個鏡頭要用After Effects渲染幾個小時,這個速度也算能接受了。

  • 頭像
    JoseRossK301
    SkillHub裡的模板是真的多,跨境電商、劇情號、產品廣告什麼場景都有。關鍵是不用自己調引數,選好模板填內容就行,對新手特別友好。

  • 頭像
    JerryRivera_Plus
    角色一致性確實是一大亮點。我之前測試過其他AI影片工具,比如Runway和Pika,生成人物稍微換個角度臉就不一樣了,根本沒法用在需要固定角色的劇情內容上。vivago在這方面做得是最穩的,它底層用的UiT架構把文字、影象、影片都統一建模了,理論上就比其他拼接式的方案好。不過偶爾在複雜場景下人物還是會有輕微變化,還有最佳化空間。

  • 頭像
    crazylion152
    國內版29元一個月還算良心,比海外版便宜不少。而且直接手機號就能註冊,不用折騰海外賬號,這點加分。

  • 頭像
    TheSimonaKishka_x
    用了vivago R1兩個月了,從灰度版一路跟到正式版,說一下我的真實感受。優點是角色一致性、中文理解能力和長影片生成這三個維度確實吊打同行。缺點也很明顯:一是收費偏貴,Pro檔60刀一個月對個人來說負擔不小;二是輸入複雜場景描述時經常有理解偏差,需要反覆調prompt;三是敏感詞檢測有時候莫名其妙,我寫「保健品」三個字就違規了,搞不懂。

  • 頭像
    Helen.Stephens_99
    免費用的很開心,看完才能徹底愛上,深度體驗後想一直用,建議大家也試試。目前還沒付費,但已經在考慮買plus了。

  • 頭像
    move8lcn
    想請教一下各位,vivago R1生成的長影片有沒有版權問題?能不能直接用在做商業廣告?官方說plus以上有商業授權,但我不太確定條款細節。

  • 頭像
    EMurrayQ998
    HiDream-O1-Image-1.5那個生圖模型真的強,1265分全球第二,我用它做了幾張產品圖完全看不出是AI生成的。相比之下,vivago的底層能力確實有保障。

  • 頭像
    鄒夢
    敏感詞檢測有點迷,我一開始沒弄好,總提示違規。反覆修改了幾次總算能正常執行了。

  • 頭像
    Jordan.Cook007012
    海外博主圈最近都在推vivago,我關注的一個YouTuber專門做了兩期評測影片。能感受到海外使用者對無限時長這個特性真的非常興奮,畢竟以前只能做15秒的片段太侷限了。