Constitutional AI
Constitutional AI是Anthropic开发的训练方法,让AI依据成文原则自行批评并修改自己的回答。
1篇文章
最近提及 Constitutional AI是Anthropic于2022年发表的AI训练方法。它先制定一份被称为“宪法”的原则清单,让模型对照这些原则批评并修改自己的回答,再把修改结果和AI给出的评价用于训练。
其特点是在减少有害性的训练中用AI反馈代替人类评分,Anthropic一直将其用于训练Claude模型。
本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。