AlphaGo 核心成员 Thore Graepel 撰文:LLM 并不真正推理
AlphaGo 团队前核心成员、UCL 教授 Thore Graepel 撰文指出,LLM 的链式推理仍是 next-token 预测,并非真正的推理,并列举三大缺陷:无可检查的认知状态、知识与推理纠缠在权重中、思维链常是事后编造。他 recently 离开 Google DeepMind,主张借鉴 AlphaGo 的博弈树架构,让系统维护可审计的认知状态并按证据更新信念。
AlphaGo 团队前核心成员、UCL 教授 Thore Graepel 撰文指出,LLM 的链式推理仍是 next-token 预测,并非真正的推理,并列举三大缺陷:无可检查的认知状态、知识与推理纠缠在权重中、思维链常是事后编造。他 recently 离开 Google DeepMind,主张借鉴 AlphaGo 的博弈树架构,让系统维护可审计的认知状态并按证据更新信念。