Google、OpenAI、Anthropicは、最先端のAIモデルを指すフロンティアAIの安全基準を定める民間組織の構想を進めています。仮称は「Standards Authority for Frontier AI(SAFA)」で、テスト、インシデント報告、安全上のコミットメントを共通の枠組みにまとめることを目指しています。SAFAは構想段階にあり、設立済みの機関ではありません。 3社の間では、この組織自身が技術評価を実施するかという中心的な問題がなお議論されています。

SAFAが担うとされる役割

構想されているのは、参加企業が自らの業界の基準づくりに関わる、業界主導の自主規制組織です。構想を進める関係者は、金融業界の自主規制機関であるFINRAを運営モデルとして検討しています。掲げる目標は、連邦政府による限定的な監督の下で、遵守を求められる業界標準を設けることです。これは組織が目指す姿であり、すでに持っている権限ではありません。

検討されている業務は、大きく分けて3つあります。SAFAはAIシステムの第三者評価を委託し、安全上のインシデントを報告する標準的な手順を策定し、企業が自主的に安全上のコミットメントを表明する際に、その内容が何を意味するかを定義する想定です。共通のテスト用ベンチマーク、つまりシステムの評価に用いる共通の尺度も計画に含まれています。これらを組み合わせれば、企業の安全対策を比較しやすくなる可能性があります。ただし、それは構想の潜在的な利点であり、SAFAが実証した成果ではありません。

抽象的なAIシステムが検査ステーション、インシデント用のトレー、白紙のコミットメントカードにつながっている

▲ SAFAが想定する業務領域

誰が評価を行うのか、未解決の問題

外部に評価を委託することと、自ら評価を行うことは異なります。3社は、SAFA自身がモデルの安全性や能力について技術評価を実施するのか、その業務を第三者に委ねるのか、まだ結論を出していません。この違いは、組織の技術的な役割を左右します。求められる水準を定めて評価を手配するだけなのか、自らも評価主体となるのかが変わるためです。

提案されている報告手順と自主的なコミットメントの定義には、関連する別の問題もあります。企業が共通基準を一貫して使うには、その意味が明確でなければなりません。しかし、現時点で示された構想では、個々のコミットメントをどう検証し、企業が守らなかった場合に何が起きるかは定められていません。遵守を求められる基準を目指すというだけで、そうした詳細まで決まっていると考えるべきではありません。

3社が民間主導の方法を選ぶ理由

米政府の大統領令を通じた取り組みがワシントンで停滞するなか、3社は独自に計画を進めました。Google、OpenAI、Anthropicは政府が運営する枠組みを待つのではなく、連邦政府の監督を限定的に受ける業界団体を検討しています。この構想は、企業による自主的な誓約と政府による直接的な規則制定の中間に位置づけられますが、具体的な権限はまだ議論の対象です。

活動を始めるとしても、何もないところに参入するわけではありません。批判する側は、既存の米政府のAI安全研究所やFrontier Model Forumを挙げ、別の組織をつくれば進行中の取り組みと重複するのではないかと疑問を呈しています。これはSAFAを独立した組織として設ける必要性への異議であり、それだけで構想を進める側が目指す個々の基準の有用性が決まるわけではありません。

誰がルールづくりを担うのか

トップの候補としては、元ホワイトハウスAI顧問、コンドリーザ・ライス元国務長官、投資家の3人が検討されています。いずれも検討中の候補であり、就任が決まったわけではありません。誰が率いるかは重要です。標準化組織は、業界全体でどのような評価、報告、コミットメントを意味のあるものとみなすかの判断に関わるためです。

この構想には、規制の虜になるリスク、つまり幅広い利益に資するはずのルールが、その策定に関わる企業に有利になるリスクをめぐる批判もあります。オープンソースの支持者やMetaとNVIDIAの幹部は、独自仕様のフロンティアモデルを手がける企業が支持する基準は、オープンソースの競合企業に対し、基準を遵守する上での障壁を課しかねないと主張しています。構想を進める側が掲げる目標は遵守を求められる業界標準の策定ですが、批判する側は大手モデル開発企業が主導する組織が業界全体を公正に代表できるのか疑問を呈しています。こうした懸念を、まだ発足していない組織に対する確定的な判断と取り違えるべきではありません。

空席が円卓を囲み、その上には釣り合った天秤があり、代表性をめぐる問いを示している

▲ 安全基準策定における代表性

今後の注目点

SAFAがどのような意味を持つかは、未決定の事項に左右されます。3社が詳細を明らかにした際には、次の4点に注目する必要があります。

  • SAFAが構想にとどまらず、正式に設立されるか。
  • 外部に評価を委託するのか、自ら行うのか、あるいは両方を行うのか。
  • インシデント報告と自主的なコミットメントの基準が、実際にどう機能するのか。
  • 誰が組織を率い、既存の安全対策に関する取り組みとどう異なるのか。

現時点では、構想の範囲は明確です。Google、OpenAI、Anthropicは、評価、報告、安全上のコミットメントに共通の方法を設けようとしています。未解決なのは、組織の権限、技術的な独立性、代表性です。今後の発表がこれらの疑問に答えたと判断できるのは、この組織が実際に何をするのかを具体的に示した場合だけです。