造AI的人比用AI的人更分裂:李飞飞捅破了这层窗户纸
「文字能扑灭火灾吗?文字能煎蛋饼吗?」——李飞飞在彭博访谈中直言,硅谷的末日叙事正在掩盖真正的治理问题。她一边创办 World Labs 押注空间智能,一边呼吁行业停止用科幻吓人、开始用科学治理。
「文字能扑灭火灾吗?文字能煎蛋饼吗?」——李飞飞在彭博访谈中直言,硅谷的末日叙事正在掩盖真正的治理问题。她一边创办 World Labs 押注空间智能,一边呼吁行业停止用科幻吓人、开始用科学治理。
李飞飞没有只停留在「骂硅谷」。她在访谈中两手都带了货:一手是 World Labs 的空间智能进展,一手是对行业叙事的系统性质疑。
World Labs 把空间智能拆成三件事——渲染(生成能看的画面)、模拟(守住物理和几何结构)、规划(告诉机器人下一步拿杯子还是放盘子)。2025 年 11 月放出 Marble,用一张图或一段文字生成可走进去、可编辑的 3D 世界;2026 年 2 月官宣新一轮 10 亿美元融资,累计公开募资约 12.3 亿美元,英伟达、AMD、Autodesk(单家投 2 亿)、a16z 都在里面。
但她也说了句不太像硅谷风格的话:世界模型现在的位置大概相当于 2019 年的语言模型,「密码还没破」。
注:World Labs 由李飞飞于 2024 年创立,专注于空间智能——让机器理解 3D 世界的物理结构、几何关系和可交互性,而非仅识别 2D 图像。
皮尤研究中心 2025 年春季跨 25 国调查给出了一个很干净的数字:中位 34% 的成年人「对 AI 日常使用增加更担忧而非兴奋」,只有中位 16% 更兴奋。美国、意大利、澳大利亚、巴西、希腊大约一半人站到「担忧」一侧。
注:皮尤 2025 年春季调查覆盖 25 个国家,中位值反映各国整体倾向。美国本土 6 月复测同样显示担忧过半。
李飞飞没有把这种情绪归给「公众不懂技术」。她原话是:AI 帮你做过去做不了的事,你拿到尊严和能动性;AI 准备取代你工位上的事,你丢的也是尊严和能动性。
她甚至把部分责任揽给自己这一代研究者——「我们在与公众沟通方面做得不够好」。这比单纯辟谣「AI 不会消灭人类」要诚实。
普通人怕的点其实三层叠着:
李飞飞很清楚,人类看世界不是只做分类。你早上睁眼,先感知空间:孩子在哪、楼梯在哪、咖啡杯离手多远。这套能力叫空间智能,它比「识图」早,也比「对话」底层。
处理的是符号世界——文字、代码、对话。能写诗、能编程、能聊天,但接不住物理世界的锅铲。
处理的是物理世界——3D 结构、几何关系、物理规律。能理解门把手在哪、碗怎么摆不会倒、机器人下一步该做什么。
李飞飞在访谈里那句反问很硬:「文字能扑灭火灾吗?文字能煎蛋饼吗?」——语言模型再能聊,也接不住物理世界的锅铲。
一个诚实的注脚:她自己也说世界模型现在还处于早期,大致相当于 2019 年的语言模型。但 ImageNet 当年也被人嫌「只是数据工程」,结果它把整个视觉领域重新定价。
不是因为她是「AI 教母」,而是因为她二十年前就做过一件类似的事:
在普林斯顿跟学生说:「计算机视觉的瓶颈不在模型,在数据」——当时主流圈子里大家都在调特征、改分类器。
ImageNet + AlexNet 把视觉领域重新定价。不是她发明了深度学习,是她创造了让深度学习能跑起来的数据基础设施。
今天她做世界模型、怼末日营销,其实是同一句话的第三遍说——机器要理解的是世界,不是硅谷董事会的 worldview;人要治理的也是世界,不是几句 AGI 咒语。
二十年绕了一圈,教机器「看」的人,现在得教造机器的人学会低头看人。
李飞飞捅破的窗户纸,不是技术秘密,而是一个行业心照不宣的默契:用「AGI 灭绝」吓住公众,就可以不用回答「谁在控制算力」「谁在定义方向」「谁在承担后果」。空间智能的真正价值不在技术指标,而在它把 AI 的讨论从「神学」拉回「工程」——机器应该理解物理世界,而不是让世界适应机器的叙事。
World Labs 尚未开放公众试用,但李飞飞在访谈中表示,空间智能的核心技术正在与机器人、建筑设计、工业仿真等领域合作推进。
worldlabs.ai → 关注进展