这期访谈全长七小时,从 2026 年 2 月雪后某个下午两点开始,一直聊到凌晨。受访人是谢赛宁,现任纽约大学教职,创立 AMI Labs 之前先后在 Google DeepMind 和 Meta FAIR 做过研究科学家,论文引用接近十万,共同提出过 Diffusion Transformers(DiT)。

AMI Labs 是他和图灵奖得主 Yann LeCun 等人搭起来的团队,做"世界模型"。截至访谈时团队只有 25 人、没有任何产品,却已经拿下一笔 10.3 亿美元的 Seed 轮,投前估值 35 亿美元,创下欧洲历史上最大的 Seed 轮。

这个开头本身就说明一些问题。一家没有产品、人数不到三十的初创公司能融到这种规模的钱,背后是资本对"世界模型"这条路线的预期,也是谢赛宁等人对主流 LLM 路线的一次公开唱反调。

AMI Labs 和一条反向路线

谢赛宁的判断很直接,他说硅谷已经被 LLM 催眠了,原话是"Silicon Valley is very LLM-pilled"。他不认为 LLM 是 Sutton 那篇《苦涩的教训》的成功例证,反而说 LLM 在某种程度上是在反抗 Bitter Lesson。他还认为语言模型的 Scaling Law 里有水分,语言本身是"毒药",甚至是一剂"鸦片",他很担心语言对视觉研究的污染,并且觉得这件事已经发生了。

这套立场把 AMI Labs 与硅谷主流 AI 研发拉开距离,也让"世界模型"成为 2026 年最值得关注的另一条 AI 路线。从融资节奏看,AMI 的第一笔融资在同类 Neo Labs 中排世界第二,仅次于前 OpenAI CTO Mira Murati 创立的 Thinking Machines Lab,那家公司拿的是 20 亿美元的 Seed 轮。

塑造他的人

访谈里占篇幅很大的部分,是谢赛宁反复描摹的几位同行和师长。他说起写《交大生存手册》的侯晓迪,想起刚到美国连 Linux 都不会用的何恺明,想起活得像"六十五岁青春期少年"的杨立昆,想起那些靠勇气和坚持让 AI 真正看见世界的李飞飞。

他很多次明明已经把话题转走了,却一定要绕回来,把一个人物的素描讲完。视频创作者在简介里解释得挺好,他最初的人生梦想是当导演,虽然这个梦很快就破灭了,但那种想给一个人物定格的冲动并没有消失,只是换成了语言的形式继续存在。

这段叙事让整期访谈在"反 OpenAI、反硅谷、反霸权"的锋利之外,仍然留了温度。谢赛宁自己总结的一句话是,这个世界上只有人与人之间真诚的交流是重要的,也许其他都不重要。

这场对话在问什么

梳理访谈的章节结构,可以把它大致分成三段。

前半段是他的个人史和学术履历,从"普通人"开始,讲到"世界不让我做视觉研究"、学术上的流浪,与何恺明的友谊,两次拒绝 Ilya Sutskever 的经历,以及对杨立昆和李飞飞的记忆。

中段进入方法论层面,他谈表征世界的隐藏线索,也把"研究品味"和《金刚经》放在一起讨论,试图回答研究里最难的判断从哪里来。

后段聚焦他当下的工作和判断,包括什么是世界模型、从"下载互联网"到"下载人类"的想象、和 LeCun 一起创立 AMI 的经过、对"硅谷已被催眠"的判断、对"人类的自大"的批评,以及一个收尾的"42"。

章节时间线

以下是访谈的官方章节,方便定位跳转。

  • 00:01:19 The Normal One · 普通人
  • 00:35:40 The World Won't Let Me Do Vision · 世界不让我做视觉研究
  • 00:52:06 Academic Nomadism · 学术流浪
  • 00:57:43 A Friendship with Kaiming He · 与何恺明的友谊
  • 01:05:35 Turning Down Ilya Twice · 两次拒绝 Ilya
  • 01:08:26 Memories of Yann LeCun and Fei-Fei Li · 杨立昆与李飞飞往事
  • 01:12:18 Hidden Clues: A World of Representations · 隐藏的线索,表征的世界
  • 02:43:55 Research Taste and the Diamond Sutra · 研究品味与《金刚经》
  • 04:11:07 What is a World Model? · 什么是世界模型
  • 04:29:47 From Downloading the Internet to Downloading Humanity · 从下载互联网到下载人类
  • 04:58:17 The Genesis of AMI Labs with Yann LeCun · 与杨立昆共同创立 AMI 的始末
  • 05:45:53 "Silicon Valley is Hypnotized" · "硅谷已被催眠"
  • 06:07:17 The Arrogance of Mankind · 人类的自大
  • 06:18:45 "42" · 42

小结

这期访谈的价值不在于给出了一个现成的答案,而在于把当下 AI 界最主流的那套叙事,连同融资、论文、人物一并摊开,让听众看到主流路线之外还有一整套不同的信念和判断。

看完之后留下几个值得回味的点。第一条,融资数字本身,没有产品、不到三十人、10.3 亿美元的 Seed 轮,说明资本已经把"世界模型"当成押注对象。第二条是他对 LLM 路线的批评,从 Scaling Law 的"水分"到语言对视觉的"污染",立场一贯、语气克制。第三条是人物的部分,那些肖像式的讲述让一场技术访谈有了人的尺度。

参考资料