2026 年3 月,巴黎新創公司AMI Labs 宣布完成10.3 億美元種子輪融資,投後估值35 億美元,創下歐洲史上最大種子輪紀錄。創始人是圖靈獎得主、前Meta 首席AI 科學家Yann LeCun。
這家公司押注的核心方向,是世界模型:它認為,大語言模型(LLM)無法真正理解物理世界,下一代AI 需要透過新的架構,學習並建構關於世界運作方式的內部模型。
在接受採訪時,公司CEO Alexandre LeBrun 曾做出一個預測:“世界模型會成為下一個熱詞。六個月內,每家公司都會自稱是世界模型公司來融資。”
他低估了這個預言實現的速度。不到六個月,「世界模型」已經演變成創業圈最炙手可熱的標籤。
根據不完全統計,截至7 月,中國已有30 餘家以「世界模型」為核心概念的創業公司,累計融資超過260 億元人民幣,其中7 家躋身獨角獸,85% 成立於2023 年之後。光是2026 年上半年,就有6 家聚焦世界模型的早期公司合計融資約97 億元。放眼全球,熱度同樣迅速升溫。 Forbes 統計顯示,2026 年上半年,風險投資流向世界模型創業公司的資金已超過30 億美元;多家頭部投資機構也在同一季度密集發布研究報告,對世界模型的評價從最初的“值得關注”,迅速變成了“不可錯過”。
大廠同樣在加速。 4 月16 日,騰訊和阿里幾乎在同一天發布了各自的世界模型產品:騰訊推出開源的混元3D 世界模型2.0,阿里則發布主打實時交互的HappyOyster。
一個月後,NVIDIA 又推出Cosmos 3 平台,這是機器人和自動駕駛訓練的實體世界模式基礎設施,並同步成立了匯集Runway、Skild AI 等公司的Cosmos Coalition 聯盟。根據科技媒體統計,英偉達 2026 年在AI 領域的股權投資已超過400 億美元,而World Labs、AMI Labs、Decart、Odyssey 等幾家最具代表性的世界模型公司,它一家不落全投了。
顯然,世界模型正迅速成為AI 產業的新焦點。但同時,它的邊界變得越來越模糊。因為當越來越多公司都開始自稱「世界模型公司」時,我們會發現它們所做的事情卻相去甚遠:有的生成視頻和三維場景,有的訓練機器人,有的服務自動駕駛,也有的試圖從底層重構AI 對物理世界的理解。
那麼,一個最基本的問題出現了:它們口中的“世界模型”,究竟是不是同一件事?
大家說的是同一個世界模型嗎?
解釋「世界模型」這四個字是一件不太容易的事。因為它既是學術概念,也是產品類別,如今更是一種融資標籤,而這三者的外延並不相同。
學術上,世界模型的想法可以追溯到1943 年,心理學家Kenneth Craik 提出的「內在模型」假說。在AI 領域,David Ha 和Jürgen Schmidhuber 於2018 年發表的論文重新活化了這個概念。但直到2024—2025 年,隨著生成式AI 的快速發展,它才真正進入產業界和資本市場的視野。
即便如此,人們對於」世界模型」的理解並沒有形成共識。在2026 年智源大會上,十餘位研究者圍繞著「到底什麼是世界模型」展開了一場公開討論,智源研究院院長王仲遠總結出至少四條技術路線:以語言為中心、以像素為中心、以三維結構為中心,以及以視覺表徵為軸心。它們分別從大語言模型、視訊生成、3D 重建和視覺表徵出發,對世界模型的定義和實現路徑都有明顯不同的理解。換句話說,這個領域連「考什麼」都沒商量好,考生已經擠滿了考場。
但在混亂之中,也有人給了回應。今年6 月,李飛飛與World Labs 團隊發表了長篇文章:《A Functional Taxonomy of World Models》。這篇文章把所有自稱“世界模型”的系統按功能分為三層:只輸出像素的“渲染器”,輸出幾何與物理狀態的“模擬器”,以及連接感知與行為的“規劃器”。李飛飛也給了一個判斷:停留在渲染器階段的系統不算是真正的世界模型。
(圖片來源:DeepTech 製圖)
這個分類法在傳播上非常成功,幾乎成了業界引用率最高的框架,也確實為混亂的討論提供了一套可用的公共語言。不過,如果把它當作衡量各家公司成色的唯一標準,恐怕也不合適。一方面,World Labs 本身就是這條賽道上的重要參與者,分類法難免帶有自身技術路線的視角;另一方面,它回答的是“什麼是世界模型”,而不是“世界模型何時能實現”。而後者,才是這輪熱潮真正重要的問題。
如果用一套稍微嚴格的標準去審視目前的新創公司,我們會發現,它們「世界模型」這個名字之下,實際上裝著五種不相關的生意:
從視訊生成起步、逐步添加物理一致性的內容公司;從3D 重建出發做空間表徵的公司;把世界模型當作機器人「想像力」的具身智能公司;試圖從底層重構AI 學習方式的新架構公司;以及用生成場景訓練自動駕駛的模擬公司。從“生成逼真的畫面”到“重新定義AI 學習世界的方式”,這之間的跨度之大,就像用“交通工具”同時描述滑板和航天飛機。
其中不少公司,在一年前的融資通稿裡,身分還是機器人公司、影音公司或3D 公司。企查數據顯示,截至2026 年3 月底,國內年內明確打出「世界模型」標籤的融資事件約25 起、總額超過22 億元;僅僅三個月後,行業全景報告統計的”世界模型創業公司”便已超過30 家。三個月冒出來的,可能不是技術,而是改過的BP。
「世界模型」怎麼變成了一個創業身分?
那麼,為什麼一個連定義都沒有的概念,反而能吸走上百億資金?答案有些現實:模糊不僅不是缺陷,反而是功能。
先看供給端。過去三年,大語言模式幾乎主導了整個AI 創業的趨勢。但進入2025 年後,圍繞Scaling Law 是否逼近收益遞減的討論持續升溫,數據瓶頸、訓練成本以及邊際收益下降,成為業界共同面對的問題。同時,大模型創業的競爭格局迅速固化:美國形成OpenAI、Anthropic 和Google 三強格局,中國則集中到位元組、阿里等少數頭部平台。數據顯示,2026 年上半年,中國AI 一級市場融資總額突破3,000 億元,但其中約930 億元流向了大模型三巨頭。留給其餘兩百多家模型公司的機會窗口正在快速縮小。
圖|2026 年上半年中國AI 一級市場融資(資料來源:DeepTech 製圖)
這段歷史並不遙遠。 2023 年百模大戰時,國內一年發布了305 個大模型;到2025 年,有媒體統計模型層公司全年只完成了22 筆融資,大模型融資佔AI 總投資的比重從51% 掉到14%。九成以上的玩家已經不在牌桌上。對於錯過或輸掉上一輪的創業者和投資人來說,他們迫切需要一個新的、足夠大的字眼。而字典裡比「世界」更大的詞,已經沒剩幾個了。
再看需求端。資本需要的恰恰是一個邊界模糊的概念。一旦定義收緊,大部分專案就會被排除在故事之外;只有足夠模糊,做遊戲的、做短劇的、做3D 素材的、做機器人模擬的,才能同時擠進同一個敘事。模糊是創投圈的共識基礎設施。於是我們看到一個耐人尋味的現象:頭部機構的研究報告爭相為世界模型描繪前景,摩根士丹利甚至預測,到2035 年世界模型賦能的產業規模將達到10 兆美元。至於這個數字如何測算,研報並未詳細展開。對資本市場而言,重要的從來不是計算過程。
此外,學者出身的明星創辦人,更為這個標籤提供了最有分量的信用背書。
李飛飛的World Labs 至少已經推出商用產品Marble;而更多打著「新架構」旗號的公司,幾乎是在零產品、零營收的狀態下完成了數億乃至數十億美元的融資。開頭提到的AMI Labs 也屬於這一類:尚無產品,CEO 也公開表示短期內沒有明確的營收目標,矽谷對它的看法因此出現了分化:一部分人視之為基礎研究的長期主義,另一部分人則視之為這輪估值熱的一個風向標。中國市場也有對應的鏡像:有新創公司幾乎在「零產品、零營收、零官網」的狀態下,就完成數億美元首輪融資。
而當「零產品估值數十億」的公司從異常值變成常態,一個概念就完成了它從研究方向到融資標籤的轉變。這一幕我們似乎並不陌生:當年「匹凸匹」改名就能漲停,Meta 為元宇宙改名後Reality Labs 虧掉600 多億美元,而存活下來的元宇宙項目,如今不少已經換上世界模型的外衣重新融資。
因此,2026 年真正誕生的,或許不是世界模型本身,而是「世界模型新創公司」這個融資「新物種」。
熱潮之外
熱潮之外,世界模型還有它真正需要解決的問題。
第一個問題,是算力。世界模型對算力的需求,遠超過許多人的想像。以像素為中心的路線,本質上是逐幀生成世界。產生一分鐘720p 視頻,意味著需要同時維持近1,800 幀畫面的空間一致性。即便是被視為技術標竿的DeepMind Genie 3,據估算,即時產生可互動環境的運作成本也高達每小時約100 美元。這個數字放到消費級產品或機器人訓練場景中,都難以支撐商業模式。
三維路線同樣不輕鬆。模型規模更大、推理更加複雜,同時具備幾何結構和物理屬性標註的3D 數據,又比網路視訊稀缺幾個數量級。更重要的是,高盛先前關於AI 基礎設施的分析指出,目前市場對算力需求的預測幾乎都建立在LLM 的成長曲線上,並未充分計入世界模型可能帶來的新增需求。大語言模型至少已經證明,持續擴展算力能夠換來能力提升;而世界模型首先擺在行業面前的,卻是一張巨額算力賬單,至於最終能夠換來怎樣的能力,仍然沒有答案。
第二個問題,是技術路線遠未收斂。技術史上,一個方向真正進入爆發期之前,往往都會經歷路線收斂:深度學習逐漸統一到反向傳播與GPU,大語言模型最終收斂到Transformer 架構和下一詞預測。
世界模型則恰恰相反。語言中心、像素中心、三維結構中心、視覺表徵中心等多條路線並行發展,不僅技術方法各不相同,甚至連「世界模型究竟該學習什麼」都尚未形成共識。對資本而言,這意味著看似押注的是同一個賽道,實際投資的,卻可能是幾套彼此競爭、甚至矛盾的技術假設。
第三個問題,是距離真正交付仍然有一段距離。世界模型最常見的願景,是讓機器人先在虛擬世界中完成數百萬次訓練,再進入現實執行任務。但距離這個目標,還有不少關鍵問題尚未解決。
今年5 月,一份引發廣泛討論的技術評估指出,整個機器人AI 產業的發展階段,遠比外界從百億美元融資規模中感受到的更早。從模擬遷移到現實(sim-to-real)的能力幾乎沒有得到系統性驗證;主流方法普遍缺乏觸覺和力回饋,而這些恰恰是機器人完成精細操作不可或缺的資訊;與此同時,模擬環境中的評測基準不斷被刷新,真實世界中的零樣本表現卻依然存在明顯差距。
目前,世界模型真正落地的產品仍主要集中在遊戲演示和內容創作等領域——這些正是對物理精度要求最低、容錯率最高的場景。具身世界模式評測基準WorldArena 的首期結果也印證了這一點:視覺效果出色,並不代表模型能夠在真實具身任務中取得同樣優秀的表現。
至於時間表,從業者本身也普遍保持謹慎。 AMI Labs CEO 曾公開表示,世界模型從理論走向商業應用可能仍需數年;不少產業分析則認為,真正具備可用性至少還需要三到五年。而這裡的“可用”,距離“可盈利”,中間仍隔著一條尚未被真正跨越的鴻溝。
不過,要強調的是,質疑熱潮不等於否定方向。讓AI 理解物理世界是一個真實且重要的研究問題,世界模型在自動駕駛模擬等少數場景中也確實開始產生收入。但一個重要的研究問題,和一個值得在2026 年以數十億美元估值下注的賽道,是兩回事:前者以十年計、靠論文推進,後者以基金存續期計、靠退出閉環。眼下的熱潮,本質上是用後者的錢和耐心,去賭前者的進度。
那位CEO 預測,六個月內每家公司都會自稱世界模型公司。他說對了。元宇宙和百模大戰的先例都表明,泡沫破裂殺不死底層技術,但會殺死大部分借概念融資的公司。真正的考驗,也許並不在今天的融資數字,而在幾年後。當算力成本開始兌現,當sim-to-real 的能力必須接受真實場景檢驗,世界模型究竟是一場技術範式的轉變,還是又一次資本敘事,答案自然會浮出水面。
讀報知天下事:為何突然冒出來這麼多「世界模型」公司?