Prime Agent开源框架让AI学会自己改自己,ARC-AGI-3冲上95.5%

Prime Agent开源框架让AI学会自己改自己,ARC-AGI-3冲上95.5%

💡 原文中文,约3300字,阅读约需8分钟。
📝

内容提要

AI考了个95.5分,比人类专家还高,但你猜怎么着?出题人慌了。 ARC-AGI-3这个专门用来考AI抽象推理的魔鬼测试,之前把各路大模型按在地上摩擦。GPT-5.6 Sol只有7.8%,Claude Opus 4.8只有1.5%。然后Prime Agent拿着Claude Opus 5跑出了95.5%,比人类专家基线95.4%还高一丢丢。但真正让人后背发凉的不是这个分数,是它怎么拿到的。...

🏷️

标签

➡️

继续阅读