Elo엘로 평점

Elo는 대결 결과를 바탕으로 상대적 실력을 추정하는 평점 체계로, AI 모델 비교에도 쓰인다.

기사 2편
최근 언급

Elo는 대결 결과와 기존 평점을 바탕으로 참가자의 상대적 실력을 갱신하는 평점 체계다. 헝가리 출신 미국 물리학자 Arpad Elo가 체스 선수의 실력을 평가하려고 고안했으며, 이름도 그에게서 따왔다. 정답률처럼 정해진 문제로 성능을 재는 점수와 달리, 비교 대상과 판정 방식에 따라 값이 달라지는 상대 평가다.

AI 분야에서는 두 모델의 답변을 나란히 비교해 더 나은 쪽을 고르게 한 뒤, 그 결과를 Elo 평점으로 환산해 모델 순위를 매기는 데 쓰인다. LMArena(옛 Chatbot Arena) 같은 모델 비교 순위표가 대표적이다.

이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.

이 항목을 다룬 기사

Gemma 4의 26B와 31B thinking 모델은 모델 사이의 상대 실력을 나타내는 Elo 점수에서 약 1440~1460을 기록했습니다.

GDPVal-AA v2.1 (실무 지식 업무, Elo) 1846 1735 1542 111점 차 선두


© 2026 AIPOST. All rights reserved.

AIPOST는 AI 활용법, AI 보안, 성능, 창업, 헬스, 윤리, 업계 소식을 다루는 AI 전문 미디어입니다. 회원 가입 없이 이용하며, 개인정보를 처리하는 방법은 개인정보 처리방침에서 확인할 수 있습니다.