黄仁勋说AGI已经实现,我更好奇那张满分卷子是怎么考的
坦白说,看到黄仁勋在财报电话会上讲「很多任务上,我们可以说已经实现了AGI」,我第一反应是撇嘴。卖铲子的宣布金矿挖通了,你信几分?
可他紧接着亲手掀了桌子:纠结AGI到底是什么、什么标准才算数,已经毫无意义。整个行业连「智能」是什么都没共识,终点线长什么样没人知道,争论定义纯属浪费时间。
真正让我坐直的,是另一张成绩单。英伟达的AVO系统,在ARC-AGI-3测试里拿了满分。这个测试专考陌生题:二十五个环境、一百八十三关,不给规则不给例题,全靠自己摸。过去,OpenAI和谷歌的最强模型上去考,连五十分都摸不到。
妙处在于满分怎么来的。同一个底层模型,裸考只有三十分;给它套上一层外壳——记住走过的每一步,发现跑偏就纠正,卡住了主动换条路——分数直接跳到一百。差的这七十分,不来自更聪明的脑子,来自一套工作方法。
这就像一个学生,知识一点没变,只是学会了记笔记、对答案、换思路,成绩从及格线蹦到了年级第一。
我的启发是:别总等着换一颗更聪明的脑子,先给自己装一套会复盘的系统。聪明是天赋,方法是选择。终点线长什么样没人知道,可会记住、会纠错、会换路的人,已经跑在路上了。