Constitutional AI
Constitutional AIは、Anthropicが開発した、文章で定めた原則に従ってAI自身が回答を批評し修正するように学習させる手法である。
記事1本
最終言及 Constitutional AIは、Anthropicが2022年に発表したAIの学習手法である。「憲法」と呼ぶ原則のリストを定め、モデルにその原則に照らして自らの回答を批評・修正させたうえで、その結果とAIによる評価を学習に用いる。
有害性を減らすための学習で、人間の評価の代わりにAIのフィードバックを活用する点が特徴であり、AnthropicのClaudeモデルの学習に使われてきた。
この説明は、AIPOSTの記事と広く知られた事実をもとにまとめたものです。誤りがあれば訂正依頼でお知らせください。