谷歌、OpenAI和Anthropic正在商讨一项提案,拟成立一家私营机构,为前沿AI(即最先进的AI模型)制定安全标准。该机构暂定名为前沿AI标准管理机构(Standards Authority for Frontier AI,SAFA),拟将测试、事件报告和安全承诺纳入统一框架。**SAFA目前只是提案,并非已经成立的标准机构。**三家公司仍在讨论一个核心问题:该机构是否应自行开展技术评估。
SAFA拟承担哪些工作
拟议中的机构将由行业主导,实行自律:参与企业将协助制定适用于自身领域的标准。筹划者正考虑以金融业自律机构FINRA作为运作范本。他们提出的目标是在联邦政府轻度监督下,建立可执行的行业标准。这描述的是该机构的目标,而非其已经具备的权力。
正在讨论的工作主要有三项。SAFA将委托第三方评估AI系统,制定安全事件报告的标准程序,并界定企业作出自愿安全承诺时这些承诺的具体含义。统一测试基准——用于评估系统的共同指标——也是计划的一部分。这些措施合起来可能使各公司的安全实践更便于比较。这只是该提案可能带来的益处,而不是SAFA已经证明的成效。

▲ SAFA拟开展的工作
谁来负责测试,仍未确定
委托外部机构开展评估,与自行评估并不相同。三家公司尚未决定SAFA应自行对模型安全性和能力开展技术评估,还是依赖第三方完成这项工作。这一区别很重要,因为它将决定该机构的技术角色:它可以制定要求、安排评估,也可以进一步成为直接开展评估的机构。
拟议中的报告程序和自愿承诺的定义还引出一个相关问题。要让各家公司一致采用某项共同标准,其含义就必须明确。但就目前披露的提案而言,尚未确定如何核查每一项承诺,也未说明企业未兑现承诺会有什么后果。不能仅凭建立可执行标准这一目标,就认定这些细节已经明确。
为什么三家公司选择私营机构方案
由于政府主导的行政令在华盛顿推进受阻,三家公司自行推进了这一计划。谷歌、OpenAI和Anthropic没有等待政府主导的框架,而是在探索设立一个接受有限联邦监督的行业组织。因此,该提案介于企业自愿承诺和政府直接制定规则之间,但其确切权限仍有待讨论。
不过,这一领域并非一片空白。批评者指出,美国政府已有AI安全研究所,也已有Frontier Model Forum,并质疑再设立一个机构是否会重复现有工作。这一质疑针对的是SAFA作为独立机构存在的必要性;但它本身并不能判定筹划者希望制定的具体标准是否有用。
谁来制定规则?
目前讨论中的潜在领导人选包括一名前白宫AI顾问、前美国国务卿康多莉扎·赖斯,以及一名投资者。这些只是正在考虑的人选,并未获任命。领导人选关系重大,因为标准制定机构将参与决定哪些评估、报告和承诺在整个行业具有实质意义。
拟议中的安排还受到有关监管俘获的批评——这种风险是,原本旨在服务更广泛利益的规则,反而偏向参与制定规则的公司。开源倡导者以及Meta和英伟达的高管认为,由专有前沿模型公司支持的标准可能给开源竞争对手设置合规门槛。筹划者提出的目标是制定可执行的行业标准;批评者则质疑,由主要模型开发商主导的机构能否公平代表更广泛的行业。这两方面的看法都不应被当作对一个尚未成立的机构的定论。

▲ 安全标准制定中的代表性
接下来要关注什么
SAFA的重要性将取决于尚未敲定的决定。三家公司披露更多细节时,值得关注以下四点:
- SAFA是否正式成立,而不再只是一个提案。
- 它是委托外部机构评估、自行评估,还是两者兼做。
- 安全事件报告和自愿承诺方面的标准将如何实际运作。
- 由谁领导,以及其工作与现有安全举措有何不同。
目前明确的是该提案的范围:谷歌、OpenAI和Anthropic希望以共同方式处理评估、报告和安全承诺。悬而未决的问题在于该机构的权限、技术独立性和代表性。只有当后续公告具体说明该机构实际会做什么时,才能将这些公告视为对上述问题的回答。