ARC-AGI

ARC-AGI是ARC Prize运营的基准测试,评估AI适应陌生问题的抽象推理能力。

1篇文章
最近提及

ARC-AGI(Abstraction and Reasoning Corpus for Artificial General Intelligence)是AI研究者弗朗索瓦·肖莱于2019年提出的基准测试,以对人类容易、对AI困难的任务衡量适应陌生问题的能力。它由非营利组织ARC Prize运营,并不断推出新版本。

与根据网格谜题的输入输出示例寻找规则的早期版本不同,第三版ARC-AGI-3要求AI在没有说明的交互式游戏环境中自行探索,找出目标和规则。除任务是否完成外,它还评估AI与人类相比的行动效率。

本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。

涉及该条目的文章

GPT-6 Astra在ARC-AGI-3上取得的99.9%和62.7%两个成绩,出自不同的测评环境。


© 2026 AIPOST. All rights reserved.

AIPOST是一家报道AI应用方法、AI安全、性能、创业、健康、伦理与行业资讯的AI专业媒体。无需注册即可使用,个人信息的处理方式请参阅隐私政策。