ARC-AGI
ARC-AGI是ARC Prize运营的基准测试,评估AI适应陌生问题的抽象推理能力。
1篇文章
最近提及 ARC-AGI(Abstraction and Reasoning Corpus for Artificial General Intelligence)是AI研究者弗朗索瓦·肖莱于2019年提出的基准测试,以对人类容易、对AI困难的任务衡量适应陌生问题的能力。它由非营利组织ARC Prize运营,并不断推出新版本。
与根据网格谜题的输入输出示例寻找规则的早期版本不同,第三版ARC-AGI-3要求AI在没有说明的交互式游戏环境中自行探索,找出目标和规则。除任务是否完成外,它还评估AI与人类相比的行动效率。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。