28 7 月 2026

李飛飛的空間人工智能初創公司世界實驗室推出首款產品

李飛飛的空間人工智能初創公司世界實驗室推出首款產品
這位斯坦福大學研究人員的初創公司旨在創建能夠流暢地適應自然世界的人工智能係統。 攝影:Yui Mok – Pool/Getty Images

去年一月,著名人工智能研究員李飛飛從斯坦福大學休學,離開學術界進入創業生活。大約兩年後,她的世界實驗室企業推出了第一個商業產品:世界大理石模型。 Marble 可以從文本、圖像、視頻甚至粗略佈局創建 3D 虛擬世界。它基於早期的 World Labs 原型,該原型從 2D 圖像創建 3D 場景,但存在交互區域有限等限制。

像 Marble 這樣的所謂世界模型是李對人工智能未來願景的核心。由於這些模型可以推理複雜的環境並與之交互,因此它們對於構建不僅理解語言而且理解物理世界本身的人工智能至關重要。世界實驗室的目標是為其係統注入空間智能,教授它們人類直觀理解的物理概念,例如在不撞到路邊的情況下停車、接住扔出的物體或不看就倒飲料。

如今,大型語言模型 (LLM) 等領先的人工智能技術正在開始改變我們訪問和使用抽象知識的方式”,李在 11 月 10 日的一篇博客文章中寫道。雄辯但缺乏經驗,知識淵博但毫無根據。”

這位研究人員表示,長期以來,對視覺和空間智能的重視一直是李的“北極星”。他在 2006 年推出了 ImageNet,這是一個包含 1500 萬張圖像的數據庫,推動了深度學習的興起。李還共同領導了斯坦福大學以人為中心的人工智能研究所,並擔任聯合國人工智能政策顧問。

然而,如今,李的重點是世界實驗室,該實驗室已籌集 2.3 億美元來實現其空間智能的願景。其支持者包括 Radical Ventures、Andreessen Horowitz 和 Nvidia,以及 Geoffrey Hinton、Eric Sc​​​​hmidt、Marc Benioff 和 Reid Hoffman 等著名科技人物。

Marble 已經進行了幾個月的測試,現已向公眾開放。它可以從單個圖像或文本消息創建整個 3D 世界。用戶還可以通過在一個提示中上傳多張圖像來合併多個上下文。據世界實驗室稱,該模型可以結合現實世界空間的照片或短視頻,創建身臨其境、逼真的虛擬世界。

該模型包括許多編輯工具,允許用戶自定義他們的創作。名為 Chisel 的功能允許用戶繪製 3D 佈局,而其他工具則可以在同一環境中擴展世界或創建全新的場景。展望未來,世界實驗室計劃為人類和人工智能體開發具有更多交互能力的世界模型。

雖然李可能是全球模特開發領域最傑出的人物,但她並不是這個領域唯一的人。谷歌 DeepMind 和 Nvidia 分別在 Genie 和 Cosmos 模型上探索了類似的技術。據報導,Meta 的首席人工智能科學家 Yann LeCun 正處於為自己的全球建模初創公司籌集資金的早期階段。

李說,像 Marble 這樣的空間智能工具的應用將“跨越不同的時間線”。該模型已被電影製作人、遊戲設計師和建築師用來改進創意工作流程。從中期來看,李預計這項技術將推動機器人技術的發展,而未來在科學、醫療保健和教育方面的應用可以實現實驗模擬、藥物發現和沈浸式學習方面的創新。

“空間智能將改變我們創造現實和虛擬世界以及與現實和虛擬世界互動的方式——徹底改變故事講述、創造力、機器人技術、科學發現等等,”李說。 “這是人工智能的下一個前沿。”

李飛飛的空間人工智能初創公司世界實驗室推出首款產品



來源連結