METR
METR는 첨단 AI 모델의 능력과 잠재적 위험을 평가하는 미국 캘리포니아주 버클리의 비영리 연구기관이다.
기사 2편
최근 언급 METR(Model Evaluation & Threat Research)는 첨단 AI 모델의 능력과 잠재적 위험을 평가하는 미국의 비영리 연구기관으로, 캘리포니아주 버클리에 있다. Beth Barnes가 Alignment Research Center(ARC) 안에서 만든 평가 조직 ARC Evals에서 출발했으며, 2023년 독립 기관이 되면서 METR로 이름을 바꿨다.
AI 모델이 사람의 도움 없이 오랜 시간이 걸리는 작업을 얼마나 해낼 수 있는지 등 자율적 능력을 측정하는 연구를 하며, OpenAI와 Anthropic 등의 모델 출시 전 평가에 참여해 왔다.
이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.
이 항목을 다룬 기사
Opus 5.5는 출시 전 METR 등 외부 평가 기관의 검증을 거쳤고, Anthropic의 종합 정렬(모델이 의도대로 안전하게 행동하는지) 평가에서 역대 최고 점수를 받았습니다.