能力边界◆ AI 生成 · 已溯源

图灵奖得主萨顿 WAIC 泼冷水:当前 AI“弱小且不可靠”,该从“人类数据时代”迈向“经验时代”

图灵奖得主萨顿 WAIC 泼冷水:当前 AI“弱小且不可靠”,该从“人类数据时代”迈向“经验时代”
结论前置 / TL;DR

2024 年图灵奖得主、强化学习奠基人理查德·萨顿在 WAIC 2026 直言当前大模型只是搬运人类知识、没有奖励信号、无法辨真伪,主张 AI 进入自我经验驱动的“经验时代”。

一句句拆台的图灵奖发言

7 月 17 日 WAIC 2026 主论坛上,2024 年图灵奖得主、强化学习领域主要奠基人理查德·萨顿(Richard Sutton)的发言不长,却几乎每句都在给当下的 AI 热潮降温。他开场就说:有些人夸大 AI 的重要性、尤其是进步速度,是有原因的;而行业普遍混淆了两个概念——智能与计算。“这里大多数是计算的能力,我们必须把两者的定义区分开。”

核心判断:还在“人类数据的时代”

萨顿认为,当前 AI 系统“主要是在使用人类知识的力量,再交付给我们,它们并没有能力发现自己的知识”,“从很多方面看它们是比较弱的”。他还纠正了一个被反复误用的概念:图灵从未提过“图灵测试”,他讲的是“模仿游戏”,而“像人一样行为”并不是图灵眼中人工智能的测试。

他最核心的判断是:我们仍处在“人类数据的时代”——大部分机器学习是把知识从人转移到机器身上,但“这种方法已经达到极限,很多高质量数据源被用完了,生成新知识是这个范式做不到的”。

主张:迈入“经验时代”

萨顿主张进入“经验时代”——AI 需要来自智能体自身经验、与世界互动的新数据源,“它是第一视角的”。他以 AlphaGo、AlphaProof 为例,并用一段婴儿玩玩具的视频说明什么叫“通过行为决定输入”:婴儿没有静态数据集,他的行为决定了他收集什么数据。

他对大语言模型的批评很直白:它们“没有奖励信号,没办法知道一个行为是好是坏”,“基本上没办法把真的和假的区分开”。结论是:“现在的 AI 智能还不够强大,我个人认为它比较弱小而且不可靠,因为会产生很多错觉。”——但他随即补了一句,“同时它是非常有用的”。

一场“微妙的对峙”

紧接其后发言的阶跃星辰、千里科技董事长印奇,则给出了乐观得多的判断:2026 年模型能力正跨越关键临界点,AI 已从只能连续执行数秒任务,进阶到能独立工作数十小时,“行业正站在 AGI 高峰的山脚下”。一位泼冷水、一位喊冲锋,两种判断在同一论坛形成了耐人寻味的对峙——而这恰恰是当下 AI 最真实的认知张力。

来源溯源(合规留痕)
https://www.ithome.com/0/978/247.htm
优秘智能 · 报名 / 联系我们

把「看懂前沿」变成「用得上」

免费公开课带你梳理 AI 落地路径,进阶到线下训练营系统学。有任何问题,随时联系我们。

✉ hello@umi6.com工作日 9:00–18:00
加入 AI 前沿社群留下联系方式,我们拉你进群,和同行一起讨论前沿信号。