
先说结论:AI 在一个“人类故意出难题”的测试里,拿了满分。
这个测试叫 ARC-AGI。
不考背题,不考知识量。
就给你几张图,让你找出规律,猜出下一张。
大人眼里是益智游戏,AI 眼里却是地狱模式。
过去最顶尖的大模型,正确率也就个位数。
英伟达昨天宣布:100%。
183 关,一关没漏。
而且这次赢法不太一样——
不是靠砸参数、拼算力。
是靠“会坚持”。
它带着记忆一步步推理,足足跑了六千多步,像做长卷一样把题啃完。

这个信号值得琢磨。
以前我们说 AI 只会接话茬。
现在它证明了一件事:它能盯着一件难事,从头做到尾,不需要人反复提醒。
满分是好事。
但也有人开始嘀咕:
哪天它觉得“要不要听人类的”也是个待解的题,怎么办?
这个问题,可能比满分本身更难回答。
留言 0
还没有留言,快来抢沙发