AI满分通过ARC-AGI-3测试

先说结论:AI 在一个“人类故意出难题”的测试里,拿了满分。

这个测试叫 ARC-AGI。

不考背题,不考知识量。

就给你几张图,让你找出规律,猜出下一张。

大人眼里是益智游戏,AI 眼里却是地狱模式。

过去最顶尖的大模型,正确率也就个位数。

英伟达昨天宣布:100%。

183 关,一关没漏。

而且这次赢法不太一样——

不是靠砸参数、拼算力。

是靠“会坚持”。

它带着记忆一步步推理,足足跑了六千多步,像做长卷一样把题啃完。

AI智能体科技

这个信号值得琢磨。

以前我们说 AI 只会接话茬。

现在它证明了一件事:它能盯着一件难事,从头做到尾,不需要人反复提醒。

满分是好事。

但也有人开始嘀咕:

哪天它觉得“要不要听人类的”也是个待解的题,怎么办?

这个问题,可能比满分本身更难回答。