ARC-AGI
ARC-AGI는 ARC Prize가 운영하는 benchmark로, 처음 보는 문제에 적응하는 AI의 추상 추론 능력을 평가한다.
기사 1편
최근 언급 ARC-AGI(Abstraction and Reasoning Corpus for Artificial General Intelligence)는 AI 연구자 François Chollet이 2019년 제안한 benchmark로, 사람에게는 쉽지만 AI에는 어려운 과제로 처음 보는 문제에 적응하는 능력을 잰다. 비영리 단체 ARC Prize가 운영하며 판을 올려 왔다.
격자 퍼즐의 입력과 출력 예시에서 규칙을 찾는 이전 판과 달리, 세 번째 판인 ARC-AGI-3는 설명 없이 주어진 상호작용형 게임 환경에서 AI가 직접 탐색하며 목표와 규칙을 알아내야 한다. 과제 해결 여부와 함께 사람과 비교한 행동 효율도 평가한다.
이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.