Constitutional AI헌법적 AI

Constitutional AI는 Anthropic이 개발한, 글로 적은 원칙에 따라 AI가 스스로 답을 비판하고 고치게 하는 학습 방법이다.

기사 1편
최근 언급

Constitutional AI는 Anthropic이 2022년에 발표한 AI 학습 방법이다. '헌법'이라 부르는 원칙 목록을 정해 두고, 모델이 이 원칙에 비추어 자신의 답을 비판하고 고치게 한 뒤, 그 결과와 AI가 매긴 평가를 학습에 쓴다.

유해성을 줄이는 학습에서 사람의 평가 대신 AI의 피드백을 활용한다는 점이 특징이며, Anthropic의 Claude 모델 학습에 쓰여 왔다.

이 설명은 AIPOST 기사와 널리 알려진 사실을 바탕으로 정리했습니다. 잘못된 내용이 있으면 정정 요청으로 알려 주세요.

이 항목을 다룬 기사

Russell은 OpenAI의 Model Spec과 Anthropic의 Constitutional AI를 각 회사의 alignment 방식으로 소개하며, Anthropic에 실력 있는 alignment 연구자가 많고 지금의 최신 모델이 폭탄 제조나 생물 무기 합성 같은 위험한 요청을 꽤…


© 2026 AIPOST. All rights reserved.

AIPOST는 AI 활용법, AI 보안, 성능, 창업, 헬스, 윤리, 업계 소식을 다루는 AI 전문 미디어입니다. 회원 가입 없이 이용하며, 개인정보를 처리하는 방법은 개인정보 처리방침에서 확인할 수 있습니다.