🧠 行业观察 · 深度反思

造AI的人比用AI的人更分裂:李飞飞捅破了这层窗户纸

「文字能扑灭火灾吗?文字能煎蛋饼吗?」——李飞飞在彭博访谈中直言,硅谷的末日叙事正在掩盖真正的治理问题。她一边创办 World Labs 押注空间智能,一边呼吁行业停止用科幻吓人、开始用科学治理。

来源:综合公开信息整理 2026-07-24 全文约 4 分钟读完
#李飞飞 #空间智能 #World Labs #AI治理 #末日叙事
🗣️ 捅破窗户纸 李飞飞:末日叙事是硅谷最便宜的洗白
1419 ImageNet 标注图片数,改变 AI 进程
$12.3亿 World Labs 累计公开融资额

⚡ 30 秒速览

  • 核心事件:李飞飞接受彭博社专访,指出硅谷用「AGI 灭绝人类」转移视线,回避算力集中、数据垄断、公众沟通缺失等真问题。
  • 她做了什么:创办 World Labs,专注空间智能,2026 年 2 月完成新一轮 10 亿美元融资,累计 12.3 亿,英伟达、AMD、Autodesk、a16z 参投。
  • 数据佐证:皮尤 2025 跨 25 国调查:中位 34% 成年人更担忧 AI 日常使用,仅 16% 更兴奋;美国、意大利、澳大利亚过半担忧。
  • 三层恐惧:生存感(工作被重估)、能量感(红利进财报不进社区)、方向感(谁在定义 AI 的未来)。
  • 她的药方:监管基于科学不基于科幻,给公共部门和 STEM 教育留资源,集体治理而非少数人定调。

01不止是批评,她手里有东西

李飞飞没有只停留在「骂硅谷」。她在访谈中两手都带了货:一手是 World Labs 的空间智能进展,一手是对行业叙事的系统性质疑。

World Labs 把空间智能拆成三件事——渲染(生成能看的画面)、模拟(守住物理和几何结构)、规划(告诉机器人下一步拿杯子还是放盘子)。2025 年 11 月放出 Marble,用一张图或一段文字生成可走进去、可编辑的 3D 世界;2026 年 2 月官宣新一轮 10 亿美元融资,累计公开募资约 12.3 亿美元,英伟达、AMD、Autodesk(单家投 2 亿)、a16z 都在里面。

但她也说了句不太像硅谷风格的话:世界模型现在的位置大概相当于 2019 年的语言模型,「密码还没破」。

12.3亿美元累计融资
2025.11Marble 3D 世界发布
2026.02新一轮 10 亿融资
3空间智能核心能力

注:World Labs 由李飞飞于 2024 年创立,专注于空间智能——让机器理解 3D 世界的物理结构、几何关系和可交互性,而非仅识别 2D 图像。

02数据摆在那里:公众不是不懂,是被吓到了

皮尤研究中心 2025 年春季跨 25 国调查给出了一个很干净的数字:中位 34% 的成年人「对 AI 日常使用增加更担忧而非兴奋」,只有中位 16% 更兴奋。美国、意大利、澳大利亚、巴西、希腊大约一半人站到「担忧」一侧。

34%
中位成年人更担忧 AI 使用增加
16%
中位成年人更兴奋 AI 使用增加

注:皮尤 2025 年春季调查覆盖 25 个国家,中位值反映各国整体倾向。美国本土 6 月复测同样显示担忧过半。

李飞飞没有把这种情绪归给「公众不懂技术」。她原话是:AI 帮你做过去做不了的事,你拿到尊严和能动性;AI 准备取代你工位上的事,你丢的也是尊严和能动性。

她甚至把部分责任揽给自己这一代研究者——「我们在与公众沟通方面做得不够好」。这比单纯辟谣「AI 不会消灭人类」要诚实。

普通人怕的点其实三层叠着:

01
生存感:工作被重估,尤其是白领活儿先被啃。不是「AI 会取代你」,而是「AI 正在重新定义你值多少钱」。
02
能量感:数据中心抢水抢电,技术红利没进社区先进财报。普通人看到的是电费涨了、水价高了,但没看到自己的生活质量因此提升。
03
方向感:当几家实验室的 CEO 既发「灭绝风险声明」,又控着 GPU、数据、招聘权,公众接收到的信号是分裂的——你一边说我快没工作了,一边说你要敬畏我创造的神。

03空间智能:比语言模型更底层的能力

李飞飞很清楚,人类看世界不是只做分类。你早上睁眼,先感知空间:孩子在哪、楼梯在哪、咖啡杯离手多远。这套能力叫空间智能,它比「识图」早,也比「对话」底层。

语言模型(ChatGPT 路线)

处理的是符号世界——文字、代码、对话。能写诗、能编程、能聊天,但接不住物理世界的锅铲。

空间智能(World Labs 路线)

处理的是物理世界——3D 结构、几何关系、物理规律。能理解门把手在哪、碗怎么摆不会倒、机器人下一步该做什么。

李飞飞在访谈里那句反问很硬:「文字能扑灭火灾吗?文字能煎蛋饼吗?」——语言模型再能聊,也接不住物理世界的锅铲。

一个诚实的注脚:她自己也说世界模型现在还处于早期,大致相当于 2019 年的语言模型。但 ImageNet 当年也被人嫌「只是数据工程」,结果它把整个视觉领域重新定价。

04三个信号,串起一条完整线索

📸 2006–2012:ImageNet 让机器「看见」改变 AI 进程

  • 1419 万张图,21841 个 WordNet 层级类别,靠 Amazon Mechanical Turk 众包标注。
  • 2012 年 AlexNet 将 Top-5 错误率从 ~28% 砸到 15.3%,深度学习从此出圈。
  • 不是某句宣言改变了行业,是 1400 万张被认真标过的图片,把「机器能不能看懂世界」从哲学问题拽成了工程问题。
核心信号:智能不是从算法里凭空长出来的,是从世界给的样本里喂出来的。

🌍 2024–2026:World Labs 让机器「理解空间」3D 世界生成

  • Marble 模型:一张图或一段文字 → 可走进去、可编辑的 3D 世界
  • 融资 12.3 亿美元,英伟达、AMD、Autodesk(单家投 2 亿)、a16z 参投。
  • 目标:让机器人进厨房、进工地、进病房不再只靠遥操作和点位编程,而是机器自己懂物理世界。
核心信号:空间智能如果走通,机器人进厨房、进工地、进病房就不再只靠遥操作和点位编程。

🗣️ 2026 年 7 月:捅破末日叙事窗户纸治理转折点

  • 用「末日叙事」挤掉「治理叙事」,是硅谷对自己最便宜的洗白
  • 谈 AGI 统治人类,就不用回答「为什么算力只长在三个州」「为什么标注工人在肯尼亚拿每小时几美元」「为什么 K-12 的 AI 素养课还没影」。
  • 她给监管提的两个底线:基于科学不基于科幻给公共部门和 STEM 教育留资源
核心信号:技术本身能找药、能陪老、能帮老师,乱的是权力结构不是矩阵运算。

05为什么是李飞飞在说这句话?

不是因为她是「AI 教母」,而是因为她二十年前就做过一件类似的事:

2006

在普林斯顿跟学生说:「计算机视觉的瓶颈不在模型,在数据」——当时主流圈子里大家都在调特征、改分类器。

2012

ImageNet + AlexNet 把视觉领域重新定价。不是她发明了深度学习,是她创造了让深度学习能跑起来的数据基础设施

2026

今天她做世界模型、怼末日营销,其实是同一句话的第三遍说——机器要理解的是世界,不是硅谷董事会的 worldview;人要治理的也是世界,不是几句 AGI 咒语。

二十年绕了一圈,教机器「看」的人,现在得教造机器的人学会低头看人。

编辑核心判断

李飞飞捅破的窗户纸,不是技术秘密,而是一个行业心照不宣的默契:用「AGI 灭绝」吓住公众,就可以不用回答「谁在控制算力」「谁在定义方向」「谁在承担后果」。空间智能的真正价值不在技术指标,而在它把 AI 的讨论从「神学」拉回「工程」——机器应该理解物理世界,而不是让世界适应机器的叙事。

了解更多

World Labs 尚未开放公众试用,但李飞飞在访谈中表示,空间智能的核心技术正在与机器人、建筑设计、工业仿真等领域合作推进。

worldlabs.ai → 关注进展