最近AI圈又因为Gary Marcus吵翻了。这位长期的AI怀疑论者在看到大模型(LLM)接连攻克IMO(国际数学奥林匹克)等顶级数学难题后,抛出一个新说法:这不是LLM变强了,而是它们“融合了神经符号工具”。
简单说,他认为大模型是靠外挂(如Lean或计算器)才变聪明的,本质上还是那个“概率预测机”。但在圈内人看来,这更像是一种为了维护面子的文字游戏。
解剖这件事的逻辑,你会发现Marcus正在把“工具调用”重新定义为他推崇了二十年的“神经符号AI”。事实是,像o1这类推理模型在不调用外部工具的纯思维链(CoT)下,数学能力已经发生了质变,甚至能处理50位数的乘法。如果一个人类数学家查了手册或用了草稿纸,你会说他“本质上不懂数学”吗?
Marcus的角度最缺的解释是:他混淆了“架构演进”与“外部辅助”。他曾预言LLM由于缺乏逻辑框架永远做不好数学,现在当结果摆在面前,他选择通过修改定义,把对方的进步强行划入自己的理论阵地。这种“永远无法被证伪”的姿态,让原本严肃的学术讨论变成了大型的注意力收割现场。