Odyssey

實時生成可互動3D影片世界的AI世界模型

深度報告

  • Odyssey 是由倫敦 AI 創業公司 Odyssey AI Lab 開發的一款革命性世界模型(World Model)產品,能夠實時生成可互動的 3D 影片世界。與傳統影片生成模型不同,Odyssey 可以讓使用者像玩遊戲一樣「走進」影片內容中進行實時互動體驗。該公司由自動駕駛領域先驅 Oliver Cameron 和 Jeff Hawke 創立,已獲得超過 2700 萬美元融資,投資方包括 EQT Ventures、GV(谷歌風投)以及皮克斯聯合創始人 Ed Catmull。技術層面,Odyssey 採用逐幀預測機制,每 40 毫秒生成一幀畫面,實現 50 毫秒內開始流媒體輸出的實時效能。雖然當前產品仍處於早期階段,視覺質量和穩定性有待提升,但其代表的新一代互動式影片技術方向值得關注。

  • Odyssey 是一家總部位於倫敦的人工智慧初創公司,成立於 2023 年左右,由兩位自動駕駛領域的資深專家聯合創立。聯合創始人 Oliver Cameron 此前在 Wayve 擔任自動駕駛 AI 研究重要職務,而 Jeff Hawke 則曾是 Voyage 自動駕駛公司的 CEO。兩人將自動駕駛領域的「世界建模」理念成功嫁接到 AI 影片技術中,創造了 Odyssey 獨特的實時互動式影片生成能力。 公司的董事會陣容堪稱豪華,包括皮克斯聯合創始人、前迪士尼動畫工作室總裁 Ed Catmull,他的加入為公司帶來了深厚的娛樂產業背景和創意內容製作經驗。這一人事佈局清晰地表明瞭 Odyssey 不僅想做一個技術工具,而是志在成為下一代娛樂內容平臺的雄心。 在資本層面,Odyssey 已完成超過 2700 萬美元的融資,主要投資方包括歐洲一線基金 EQT Ventures、谷歌風投 GV 以及 Samsung Next。這些頂級投資機構的背書,不僅為公司提供了充裕的研發資金,也為其帶來了豐富的產業資源和戰略支援。

  • Odyssey 的核心功能是將靜態影片轉化為可互動的實時 3D 世界,使用者可以透過鍵盤、手柄等裝置控制視角,在生成的內容中自由探索。產品最突出的技術特點是其實時性:每 40 毫秒生成一幀畫面,使用者輸入後僅需 50 毫秒即可看到響應,實現了真正意義上的實時互動體驗。與傳統影片生成模型需要數分鐘等待不同,Odyssey 讓使用者能夠在影片世界中即時開始探索。 在輸出時長方面,Odyssey 能夠生成 5 分鐘或更長時間的一致性影片流,突破了傳統 AI 影片模型只能生成 10 秒片段的限制。系統支援影象提示和文字提示兩種輸入方式,使用者可以基於現有影象或文字描述生成互動式世界。 從技術架構來看,Odyssey 採用的是世界模型路線,這與楊立昆(Yann LeCun)和李飛飛等 AI 領域權威推崇的「世界模型」理念一脈相承。與傳統擴散模型逐幀生成的方式不同,Odyssey 模擬大語言模型預測下一個單詞的思路,持續預測下一幀內容,形成連貫的世界演化。為解決 AI 影片領域常見的「畫面漂移」問題——即隨著時間推移畫面逐漸失真變形——Odyssey 採用了「窄域預訓練」策略,先在大量通用影片上培養基礎理解,再針對特定環境微調以提高穩定性。 在產品定位上,Odyssey 明確表示將與創意專業人士合作而非取代他們。軟體允許將生成的場景匯出到 Unreal Engine、Blender、Adobe After Effects 等專業工具中進行手工編輯,這一定位有助於緩解創意產業對 AI 取代人類的焦慮。 當前產品仍處於早期階段,存在明顯的侷限性。生成環境的視覺質量不夠清晰,存在一定程度的模糊和失真;空間一致性不足,在場景中行走一段時間或轉身後,周圍環境可能出現明顯變化;時間穩定性有待改善。這些「粗糙的邊緣」是公司自己也承認的現實,公司表示正在針對更豐富的世界表示、提高時間穩定性、擴充套件動作空間等方面進行改進。

  • 截至目前,Odyssey 仍處於早期免費體驗階段,使用者可以透過官網體驗入口進行試用。但由於 GPU 供應有限,體驗名額可能受到限制。 對於商業化路徑,公司已開放 API 訪問申請,開發者可以透過 Odyssey 開發者平臺獲取 API 介面。官網顯示運營成本約為每使用者小時 1-2 美元(基於 Nvidia H100 GPU 叢集執行),這一成本結構決定了未來商業化定價需要在這一定價基礎上進行調整。 從商業模式來看,Odyssey 的願景是「將一切影片內容轉化為互動式影片」,這一定位意味著其商業化路徑可能包括:面向企業的 API 呼叫付費、面向創作者的專業版訂閱、以及面向消費者的娛樂內容平臺。鑑於團隊深厚的自動駕駛背景,公司也可能將技術授權給機器人、智慧導航等領域的應用場景。

  • 從技術演示和早期使用者體驗反饋來看,Odyssey 引發了較高的關注度。使用者對其「走進影片」的創新互動形式普遍感到興奮,多家科技媒體進行了專題報道。實時互動的能力被認為是革命性的突破,50 毫秒的響應延遲讓「即時開始」的體驗成為可能。 然而,早期體驗也暴露了一些批評意見。核心問題集中在視覺質量上——生成的環境被反饋「模糊且失真」,與當前頂級 AI 影片工具(如 Runway、Pika)的清晰度存在差距。此外,場景穩定性是另一個被頻繁提及的問題,有使用者報告在場景中移動後,周圍環境會出現「看起來突然不同」的情況。 從社交媒體討論來看,技術愛好者和 AI 從業者對 Odyssey 普遍持積極態度,認為其代表了一個新的技術正規化。但創意社群的反饋則更為複雜:一方面有人期待這一工具能提升創作效率,另一方面也擔憂這是否會進一步衝擊已經受到 AI 影響的創意工作崗位。

  • 主流科技媒體對 Odyssey 給予了高度關注。TechCrunch 將其描述為「讓使用者與流媒體影片進行互動」的創新產品,認為其開創了「互動式影片」的新概念。行業觀察者普遍將 Odyssey 與 DeepMind、World Labs(由 AI 研究先驅李飛飛創立)、Microsoft 等正在開發世界模型的公司並列,認為這一技術方向正在成為 AI 影片領域的下一個熱點。 從競爭格局來看,Odyssey 並非唯一追逐世界模型的公司。DeepMind 擁有強大的研發資源和人才儲備,World Labs 背靠 AI 領域頂級學術背景,Microsoft 已釋出了 AI 生成《雷神之錘 2》的演示,Decart 則開發了可實時遊玩的《我的世界》AI 模擬。在這一競爭激烈的賽道上,Odyssey 的差異化優勢在於其創始團隊的自動駕駛背景帶來的實時互動能力,以及皮克斯背景帶來的娛樂產業視角。 專家分析認為,世界模型技術的成熟將深刻改變內容生產方式。行業預測,未來這一技術可應用於建立互動式媒體(遊戲、電影)、執行真實模擬(如機器人訓練環境)、以及娛樂、廣告、教育、培訓、旅遊等多個領域。Odyssey 能否在競爭中脫穎而出,取決於其技術迭代速度和商業化能力。

  • Odyssey 面臨的最大爭議來自創意產業對 AI 取代人類的擔憂。《連線》雜誌的調查發現,動視暴雪等遊戲工作室已經在使用 AI 技術削減成本和對抗人員流失,已出現大規模裁員。美國動畫協會 2024 年的研究估計,未來幾個月將有超過 10 萬個美國電影、電視和動畫工作崗位受到 AI 衝擊。 儘管 Odyssey 宣告其定位是「與創意專業人士合作」而非取代,但技術本身的中立性使其應用方式存在不確定性。如果這一技術被大規模用於降低內容生產成本,可能加劇創意產業的就業壓力。 從技術風險角度,當前產品的成熟度不足是主要問題。視覺質量、空間一致性、時間穩定性等核心指標距離商業化應用標準還有明顯差距。公司需要持續投入研發資源進行改進,這一過程可能需要數年時間。 此外,作為新興技術,世界模型的監管框架尚不明確。如果 AI 生成內容涉及版權問題、虛假資訊傳播等風險,可能面臨政策調整帶來的不確定性。

  • Odyssey 目前最適合以下使用者群體:AI 技術研究者和開發者可以透過 API 接入,探索世界模型的技術邊界;創意內容創作者可以利用其生成能力作為靈感來源或草稿工具,並透過匯出到專業軟體進行精細化編輯;科技愛好者可以體驗互動式影片的前沿概念。 對於普通消費者,當前階段的免費體驗值得一試,但需要管理預期——產品仍處於早期,視覺效果和穩定性與成熟產品有差距。 不太適合當前階段使用 Odyssey 的場景包括:需要高質量商業影片內容的專業製作團隊(建議等待技術成熟後再評估);對互動穩定性要求極高的應用場景;對畫面清晰度有嚴格要求的用途。 替代方案方面,如果需求是傳統 AI 影片生成,可以考慮 Runway、Pika Labs、Luma Dream Machine 等成熟產品;如果需要 3D 場景生成,World Labs 和 Microsoft 的相關產品值得關注;如果目標是遊戲內實時 AI 生成,Decart 的 Minecraft AI 模擬是類似方向。

  • Odyssey 代表了 AI 影片生成領域的一個重要技術突破——從被動觀看轉向主動互動。雖然當前產品仍處於「粗糙的邊緣」的早期階段其實時流媒體輸出和開放式互動能力讓我們得以窺見下一代內容形式的雛影。公司創始團隊兼具技術深度和產業視野,融資充足且有頂級顧問加持,為長期發展奠定了基礎。然而,創意產業的就業焦慮、技術成熟度的挑戰、以及日益激烈的市場競爭,都是 Odyssey 需要正視的風險。對於關注 AI 內容技術方向的從業者和愛好者,Odyssey 是一個值得持續關注的專案,但其承諾的「影片內容互動化」願景何時能真正普及,還有待技術演進和市場檢驗。

使用者評論

  • 頭像
    Frances.Wilson_2023
    剛體驗了一波 Odyssey,不得不說這個實時互動是真的香!50毫秒響應,玩起來基本感覺不到延遲,比之前用過的那些AI影片工具流暢太多了。

  • 頭像
    Judy.Castillo
    和 Runway、Pika 比起來,Odyssey 的互動性確實是獨一檔,但畫質還是有點拉胯,生成的場景有些模糊,希望後續能最佳化。

  • 頭像
    暖陽574
    看演示影片覺得挺牛的,但實際用起來發現畫面漂移問題還是存在,走一段時間後周圍環境就變樣了,穩定性有待提高。

  • 頭像
    trueJohnniNewman_2024
    創始人是從 Wayve 出來的自動駕駛大牛,團隊還有皮克斯的 Ed Catmull 坐鎮,這背景是真的強,融資2700萬美元不奇怪。

  • 頭像
    Cha_inDex
    免費的體驗名額太少了,GPU 供應有限,每次想用都要排隊等,哭了。

  • 頭像
    Nancy_Scott369211
    技術方向挺看好的,世界模型這條路線比傳統擴散模型更有想象力,期待後續版本的表現。

  • 頭像
    jaSUL
    用鍵盤 WASD 控制就能在生成的影片裡漫遊,有一種玩第一人稱遊戲的感覺,沉浸感拉滿了。

  • 頭像
    realHarveyBlack_pro
    40毫秒生成一幀是什麼概念?人類眨眼都要100毫秒,AI這波真的是瞬間生成了,響應速度快到離譜。

  • 頭像
    Andrew.Rogers007
    目前還在早期階段,demo 確實比較粗糙,邊緣有些模糊,但對於一個新領域來說已經很強了。

  • 頭像
    AnthonyNielsen
    可以匯出到 Unreal Engine、Blender 這些專業工具進行二次編輯,這點對創作者很友好。

  • 頭像
    NObai
    剛在 Product Hunt 上看到 Odyssey-2 Max 上榜了,拿到了 123 個贊,確實很受關注。

  • 頭像
    3yc_97u
    和美國那些世界模型專案比如 DeepMind、World Labs 相比,Odyssey 的實時互動能力是最大亮點。

  • 頭像
    Elizabeth.KellyQ818
    能生成5分鐘以上的長影片流,這點比只能生成10秒的競品強太多了,場景持續性更好。

  • 頭像
    JohnCox520
    支援影象和文字兩種提示方式,用起來比較靈活,我比較喜歡用影象生成。

  • 頭像
    Jacqueline.Vasquez16830
    運營成本每使用者小時1-2美元,未來如果收費的話這個價格還算合理,就看體驗值不值這個價了。

  • 頭像
    Henry_ThompsonK
    看到知乎上有人討論說這個可能會衝擊創意產業崗位,確實有點擔憂,做影片的要失業了?

  • 頭像
    AKelly_2022
    用了窄域預訓練策略來解決畫面漂移,思路挺聰明的,實際效果也還行。

  • 頭像
    IMyers_20231
    說實話現在這畫質還達不到商業應用的標準也就是玩票性質但技術潛力很大值得持續關注。

  • 頭像
    Brandon.HowardSr4
    看了 TechCrunch 的報道,說這技術可以應用於遊戲、電影、教育、旅遊等多個領域,前景廣闊。

  • 頭像
    SamanthaMurphy
    兩位創始人一個來自 Wayve,一個來自 Voyage,都是自動駕駛領域的,做的卻是影片生成,跨界的思路很妙。