文章总结: 本文借李飞飞将WorldLabs售予AMD一事,探讨AI本质与人类认知边界。核心观点为世界非由词组成,语言模型是开环系统,而人类智能建立在身体与世界的实时闭环上。文章回溯维纳控制论,对比笛卡尔、维特根斯坦与身体哲学,警示人勿活成大语言模型,应回归身体感知与物理世界。建议AI时代重视空间智能与闭环反馈,保持人的本能与物理接触。
综合评分: 78
文章分类: AI安全,安全意识,深度思考
人别活成大语言模型:李飞飞凿物理世界,维纳七十年前就敲过警钟
原创
APT-101
APT-101
APT-101
2026年9月29日 19:08
陕西
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
AI时代#控制论#认知#深度思考
01 一笔交易最扎眼的,不是 82 亿
AMD 用 82 亿美元全股票收购 World Labs 的消息传开时,大家的注意力都在钱上:两年、一家公司、顶级女性科学家与芯片女王会师。少有人注意到李飞飞为这桩交易写下的话——”世界不是由词组成的”。
她说的是模型:真正的 AGI 不会从文字接龙里长出来,机器要走进工厂、医院、机器人身体里,唯一的路是学会感知、推理、构建三维世界。
这句话放在 2025 年,是对过去三年”语言狂热”的一盆冷水。但如果你往深了想一层,会发现她说的根本不只是 AI——它是维纳在 1948 年写《控制论》、1950 年写《人有人的用处》时,就想对所有人说的一句话。七十多年前,有个老头已经在为今天的人写墓志铭了。
原书存照 · 诺伯特·维纳《人有人的用处》(1950 年首版,1954 年修订): “信息,是我们与外部世界进行交换的内容的名称:我们调整自己去适应它,并把我们的调整作用回它身上。” ——七十年前的这句定义,和”世界不是由词组成的”,说的是同一件事。
02 世界的本质:三个哲学家给过三种答案
先不急着聊 AI。把”世界不是由词组成的”这句话放回哲学史里,会发现它其实是一个古老问题的当代回声:世界到底是什么?
这个问题,西方哲学给过三种经典答案。
笛卡尔把它劈成两半。17 世纪,他怀疑眼前的一切都可能是假的——也许有个恶意的精灵在骗你。唯一骗不了人的,是”我在怀疑”这件事本身。于是他写下”我思故我在”:思维是唯一确凿的东西,物质、身体、世界,是另外一码事。这套二元划分影响了几百年:思维在上,身体在下;词是思想的载体,物理世界只是思想发生的舞台背景。
维特根斯坦把世界收进词里。《逻辑哲学论》开篇第一句:世界是事实的总和,不是事物的总和。再往后还有一句更狠的:我的语言的界限,就是我的世界的界限。意思是人只能在自己的语言框架里思考世界——语言画的框有多大,世界就有多大。过去三年的生成式大模型热潮,几乎是这句话最忠实的商业注脚:把语料喂得足够大,就是不断往外推”语言的界限”,推到让人以为那就是世界的全部。
第三家反对以上两者。梅洛-庞蒂和海德格尔说:人从来不在语言里,人在世界之中——用身体。知觉先于概念,身体是世界的器官,世界不是思维的舞台,而是我们存在的方式。你先是身体,然后才是会说话的人。人的物理直觉比语言老,这在发展心理学里是早就被实验支持的事实。
三种答案,三种姿势:笛卡尔把词和世界切开,维特根斯坦把世界扣在词里,身体哲学把世界放回身体。而七十年前的维纳给出的是第四种:世界既不在词里,也不在身体里,而在身体与世界之间那圈”反馈回路”里。他讲得最系统,也最像工程图。
控制论的故事,从 1948 年说起。
03 维纳的 1948:信息不是词,是差异
诺伯特·维纳被称作”控制论之父”。1948 年他把二战时期为防空火炮做预测机(追踪飞行轨迹、提前算弹着点的装置)的工作,升华成一本跨时代的书。书名叫《控制论》,副标题是”动物与机器中的通信与控制”。
“控制”这个词,在希腊语里原意是”舵手”。一个舵手掌舵,不断看目标、看实际航向、看风和海流,然后修正——维纳说,这个”看动作—修正动作”的循环,就是一切智能系统的基本单位。他叫它反馈。
维纳对”信息”的定义也非同寻常。信息不是词语、不是句子、不是知识。在他和香农那个时代的数学框架里,信息是”差异”——是消除不确定性。一件事有十种可能,你被告知其中一种,这是信息;一段话不消除任何不确定性,它就不携带信息。
注意这里的推论:词语只是信息的载体之一,而且是个简陋的载体。维纳从没说过”世界是由词组成的”。他说的是,生命与机器都在”以负熵为食”——从环境中读取差异、利用差异活下去。真实世界的差异,远比语言能描述的差异多。
04 文本是世界的采样,不是世界本身
把李飞飞那句话装进维纳的框架,就变成了一次几乎等价的表述。
人类语言的信息带宽低得可怜。正常语速的口语,换算成信道,有效信息率只有每秒几十比特的量级——这是 Shannon 信息论里的经典常数。而真实物理世界是什么量级?机械臂推倒一个杯子,从倾斜、失稳、滑落、撞击到液体溅出,一秒之内产生的连续状态,够写几百页说明书都写不完。
所以词,本质上是对世界的”采样+压缩”。名词动词把连续时空切成离散的桶,每个桶贴一个标签——这个切割动作本身就在丢信息:说得出来的,是语言里已经有过的维度;说不出来的、从没被人提炼成词的东西,在语料里根本不存在。
语言模型穷尽一生读到的,不是世界,是世界被人的思维压缩过一次之后的投影。它不是看不见物理世界,是物理世界从源头就进不了词这个信道。李飞飞的”世界不是由词组成的”,在信息论意义上几乎是陈述句。
05 关键区别:开环的机器,闭环的人
如果只停留在”语言带宽低”,这只是个比喻。维纳的框架还给了我们一把更锋利的刀:开环和闭环。
一个系统如果行动了却不测量后果、不根据后果修正下一步,叫开环。一个系统行动、感知、比较、修正,循环往复,叫闭环。维纳当年反复强调:任何有意义的控制都必须闭环——飞机没有仪表的反馈修正就会漂移,火炮没有弹道修正就打不中,连人走路,都是步步感知、步步修正的过程。
现在的大语言模型,本质上是”开环”的:你给它输入,它一次性地生成完一整段输出,过程中不读取任何世界状态。它生成的句子再漂亮,也不会因为”这句话落进现实后造成了什么”而调整。它的反馈,只发生在下一个对话里,还是文字形式的反馈。
这也是李飞飞那句话最精确的地方:文字接龙,是一个完美的开环闭环。语言模型在其中转得再快,也是在文字自身的回声里打转——就像一台永远在自说自话、永远不上路试车的驾驶仪。
而人不是开环的。人的每一个动作都带着传感器的回报:手碰到杯子,有触觉;杯子滑落,有视觉和听觉;摔碎了,有后果。人的智能建立在”身体—世界”的实时闭环上。维纳会说:人的用处,正在这个闭环里。
06 回归本能:人身上被忽略的那条信道
这就说到”AI 时代要回归人的本能”。
先说清楚:本能不是反智,不是让 AI 时代的人退回直觉崇拜。用维纳的话说,本能是人在演化中长出来的、语言之外的感知—行动回路——触觉、本体感觉、肌肉反馈、空间感、对重力和因果的预判。这些回路比语言老得多,也稳得多。
发展心理学里有一个常被引用的经典实验:给 11 个月的婴儿看一个球,本应落下来,却违反物理直觉地悬浮在半空——婴儿会明显地多看、多探索。他们在学会任何词之前,就已经带着一整套”物理世界应该怎样运行”的预期在感知世界。语言的习得,是建立在这套物理直觉之上的上层建筑。
换句话说,人类的天性里,物理世界模型本来就先于语言存在。李飞飞要给机器补的”空间智能”,恰恰是人类身上最古老、最理所当然、也因此最不被珍惜的能力。可笑的是,过去三年里,我们把最古老的能力晾在一边,一头扎进最年轻的信道——文字——里,以为那就是思考的全部。
07 最深的警告:别让自己变成开环的人
维纳写《人有人的用处》时,有个非常personal的语境:他二战后公开地与军事项目保持距离,转而研究”机器到底会被怎样使用”这个问题。他最担心的不是机器变聪明,而是——人以为自己可以像机器一样被使用,或者更糟,人主动把自己活成机器。
把这个问题抛回今天:一个普通人,如果每天的生活就是读词、写词、刷词、用词回复另一个词,他的信息输入就退化成了一条纯文字信道。他的”世界”也开始由词组成:从别人的描述里知道世界、从热搜里定义情绪、从评论里获得立场。他不再用身体测量,只在文字里接龙——恭喜,他把自己做成了一个大语言模型:开环、自指、越来越绕不出语料本身。
还有一层更现实的风险:文本世界在自我复制。当语料里越来越多混入 AI 生成的内容,模型学的是”AI 眼里的世界”,源头在漂移,纯度在下降。人如果只活在词里,一样的漂移也在人身上发生——你以为自己在接触世界,其实在接触”关于世界的说法”,而且这些说法正在互相引用、闭环更新。
08 李飞飞和 AMD 给的注脚
把这条线拉回新闻本身,你才看得懂这桩交易的另一层含义。
李飞飞这两年做的事,不是给模型灌更多词,而是给模型装”视网膜”:用照片和视频,让模型直接从连续物理世界采样、推演空间、生成可供机器人训练的孪生环境。她选择的闭环方式,和维纳规划的反馈结构是同构的——给系统一个对物理世界的测量通道。
AMD 买的也不只是”下一家好公司”。芯片界已经看懂:下一个十年的算力负载,可能不再只是稠密的文字矩阵,而是实时渲染、空间推理、机器人的感知与运动控制——空间模型的乘积。谁定义了这个负载,谁就定义了下一代计算。所以这笔交易买的是”解释权”:下一个十年,芯片为谁而造。
人和这件事的关系,是同一个结构的镜像。下一个十年,计算往物理世界去,人却缩进文字里——那才是真的错位。
09 收束
“世界不是由词组成的。”李飞飞对模型说的这句话,维纳在七十年前对人说过一遍:人的用处,不在能吐出多少正确的词,而在有一个能感知、能行动、能承担后果的身体,和一套完整的闭环。
AI 时代回归人的本能,不是说人应该放弃理性去信直觉,而是提醒你:你的传感器还开着吗?你上一次用手去摸、用脚去走、让一件事在自己身上发生而不是在屏幕上发生,是什么时候?
模型的下一站在物理世界,人的归宿从来也在那里。别把自己活成大语言模型——那是维纳最想对 AI 时代的人说的话。
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:APT-101 APT-101
APT-101《人别活成大语言模型:李飞飞凿物理世界,维纳七十年前就敲过警钟》