Constitutional AI

Constitutional AIは、Anthropicが開発した、文章で定めた原則に従ってAI自身が回答を批評し修正するように学習させる手法である。

記事1本
最終言及

Constitutional AIは、Anthropicが2022年に発表したAIの学習手法である。「憲法」と呼ぶ原則のリストを定め、モデルにその原則に照らして自らの回答を批評・修正させたうえで、その結果とAIによる評価を学習に用いる。

有害性を減らすための学習で、人間の評価の代わりにAIのフィードバックを活用する点が特徴であり、AnthropicのClaudeモデルの学習に使われてきた。

この説明は、AIPOSTの記事と広く知られた事実をもとにまとめたものです。誤りがあれば訂正依頼でお知らせください。

この項目を扱った記事

ラッセルはOpenAIのModel SpecとAnthropicのConstitutional AIを両社のアライメント手法として紹介し、Anthropicには優れたアライメント研究者が数多くいること、そして現在の最先端モデルが爆弾製造や生物兵器のレシピといった危険な要求を確実に拒否していることを認めています。


© 2026 AIPOST. All rights reserved.

AIPOSTは、AIの活用法、AIセキュリティ、性能、起業、ヘルスケア、倫理、業界ニュースを扱うAI専門メディアです。会員登録なしで利用でき、個人情報の取り扱いはプライバシーポリシーで確認できます。