2016年3月10日,首尔四季酒店。在人机围棋对局中,韩国九段棋手李世石正与AlphaGo进行第五局较量。当AlphaGo在第37手悄然落子于五路肩冲时,现场哗然。此举在围棋界被视为愚蠢的失误,李世石对此一时无言,经过长达15分钟的思考,才决定如何应对。这一刻改变了围棋历史,更是科技发展的里程碑。

十年后,随着大语言模型如ChatGPT的流行,科技界普遍认为机器已经获得了类人思维。但这时,AlphaGo的核心成员之一Thore Graepel选择离开Google DeepMind,并在《麻省理工科技评论》上发布长文,毫不客气地批评当前大语言模型的“思维链”概念,称其为自欺欺人的伪装。

Graepel在文中指出,今天的人工智能并未掌握像“第37手”那样的灵魂。第37手实际上是基于冷静的底层搜索机制,而非神秘的灵感。AlphaGo有两个核心组件:一是系统1,模仿人类直觉;二是系统2,进行严谨的推理。面对当时的局面,系统1认为此手的可能性几乎为零,但系统2通过复杂的推演,让这一看似错误的选择成为制胜关键。 pg电子赏金女王

相较之下,当今的大语言模型只是一种复杂的自回归系统,无法真正进行深度推理。Graepel认为,其“思维链”不过是简单的长时间猜测,不具备实际的认知能力。他指出大语言模型的三大缺陷:缺乏透明和独立的认知状态,知识与逻辑混淆不清,以及无法准确地自我修正。

Graepel的反思揭示了现代AI技术的局限性,强调真实推理和创造力依然需要严谨的逻辑与深刻的理解,而不是简单的模式识别和猜测。