Constitutional AI

Constitutional AI是Anthropic开发的训练方法,让AI依据成文原则自行批评并修改自己的回答。

1篇文章
最近提及

Constitutional AI是Anthropic于2022年发表的AI训练方法。它先制定一份被称为“宪法”的原则清单,让模型对照这些原则批评并修改自己的回答,再把修改结果和AI给出的评价用于训练。

其特点是在减少有害性的训练中用AI反馈代替人类评分,Anthropic一直将其用于训练Claude模型。

本条目依据AIPOST的文章与广为人知的事实整理。如有错误,请通过更正请求告诉我们。

涉及该条目的文章

他把OpenAI的Model Spec和Anthropic的Constitutional AI介绍为两家公司的对齐方法,指出Anthropic拥有众多优秀的对齐研究人员,并承认如今的前沿模型能够可靠地拒绝危险请求,例如制造炸弹或生物武器的配方。


© 2026 AIPOST. All rights reserved.

AIPOST是一家报道AI应用方法、AI安全、性能、创业、健康、伦理与行业资讯的AI专业媒体。无需注册即可使用,个人信息的处理方式请参阅隐私政策。