Google, OpenAI, Anthropic이 AI 안전 기준을 함께 다룰 민간 기구를 논의하고 있습니다. 가칭은 Standards Authority for Frontier AI(SAFA)입니다. 외부 평가와 사고 보고 방식 등을 공통 기준으로 만들려는 구상이지만, 출범이 확정된 조직은 아닙니다. 지금 구분해야 할 것은 세 기업이 추진하는 방향과 아직 합의하지 못한 권한의 범위입니다.

왜 공동 기구를 제안했나

SAFA 구상은 미국 워싱턴에서 정부 주도의 행정명령 추진이 정체된 뒤 별도로 진전됐습니다. 정부가 기준을 마련하기를 기다리는 대신, 기업들이 참여하는 자율규제 기구를 통해 업계 기준을 세우려는 방향입니다. 연방정부가 제한적으로 감독하는 형태도 구상에 포함돼 있습니다. 다만 이를 이미 시행 중인 제도나 확정된 감독 체계로 받아들여서는 안 됩니다.

운영 방식의 참고 사례로는 금융업계의 자율규제 기구 FINRA가 거론됩니다. SAFA 역시 단순한 의견 교환을 넘어, 업계에 구속력 있게 적용할 기준을 만들겠다는 취지입니다. 그러나 금융업계의 사례를 참고한다는 것과 AI 기업에 실제로 어떤 권한을 행사할 수 있는 조직이 만들어진다는 것은 다른 문제입니다. 현재 단계에서 확인할 수 있는 것은 설립을 위한 협의와 제안된 업무 범위입니다.

이 논의는 AI 시스템에 더 많은 역할을 맡기려는 흐름과도 맞닿아 있습니다. 기존 모델의 기능조차 충분히 활용하지 못하는 기업과 이용자가 있는 한편, 더 넓은 컴퓨터 사용 권한이나 일정·이메일 연동을 허용하는 데에는 데이터 보호와 신뢰에 관한 우려가 남아 있습니다. 이런 상황에서 공통 안전 기준을 마련하려는 시도는 배포와 사용 과정에서 무엇을 점검할지 분명히 하려는 움직임으로 읽힙니다. 다만 컴퓨터 사용 권한이나 데이터 보호 같은 항목이 SAFA의 개별 기준으로 제시된 것은 아닙니다.

논의 중인 역할은 세 가지

SAFA가 맡을 업무로 제시된 범위는 평가, 사고 보고, 안전 약속의 정의입니다. 각각은 다음과 같이 구분할 수 있습니다.

  • 제3자 평가 의뢰: 외부 평가를 통해 AI 시스템의 안전성과 능력을 점검하는 방안입니다. 기구가 직접 평가까지 수행할지는 별도 쟁점입니다.
  • 사고 보고 방식의 표준화: 문제가 발생했을 때 어떤 절차로 보고할지 공통 방식을 마련하는 방안입니다.
  • 자발적 안전 약속의 정의: 기업이 자발적으로 내건 안전 약속이 무엇을 뜻하는지 명확히 하는 방안입니다.

세 업무에는 공통으로 ‘누가, 무엇을 기준으로 확인할 것인가’라는 질문이 따라붙습니다. 외부 평가를 의뢰하는 일과 기구가 자체적으로 기술 평가를 하는 일은 권한과 책임이 다릅니다. 사고 보고 절차를 정하는 일도 보고 자체가 이뤄졌는지 확인하는 문제와는 구별됩니다. 제안된 업무를 읽을 때에는 목표뿐 아니라 실제 운영 방식이 어디까지 합의됐는지 살펴봐야 합니다.

AI 시스템 주변에 외부 평가와 사고 보고, 안전 약속을 나타낸 모습

▲ 평가와 사고 보고

직접 평가 권한은 아직 이견이 있다

세 기업 사이에는 SAFA가 안전성과 능력에 관한 기술 평가를 직접 수행해야 하는지를 놓고 이견이 남아 있습니다. 제3자에게 평가를 의뢰하는 역할에 그칠지, 기구 내부에도 평가 기능을 둘지는 조직의 성격을 바꾸는 선택입니다. 따라서 ‘공동 안전 기구’라는 이름만으로 평가 주체와 권한이 정해졌다고 볼 수 없습니다.

지도부 인선도 논의 대상입니다. 그러나 인물이나 운영 방식에 관한 논의가 있다는 사실은 조직 구성의 확정과 다릅니다. SAFA는 현재 가칭이며, 누가 이끌고 어떤 절차로 기준을 정할지까지 확정된 기구로 설명해서는 안 됩니다.

기존 기구와 무엇이 달라야 하나

SAFA를 둘러싼 비판은 두 갈래입니다. 하나는 기존의 AI 안전 관련 기관인 Center for AI Standards and Innovation(CAISI), 그리고 Frontier Model Forum과 역할이 겹칠 수 있다는 우려입니다. 새로운 기구가 어떤 공백을 메울지 분명하지 않다면, 기준을 하나 더 만드는 것만으로는 역할을 설명하기 어렵다는 지적입니다.

다른 하나는 대형 AI 기업이 주도하는 자율규제가 경쟁에 미칠 영향입니다. NVIDIA의 Jensen Huang, Meta의 Mark Zuckerberg 등 오픈소스 진영에서는 안전 기준이 작은 경쟁자에게 부담을 주고 기존 기업에 유리한 진입 장벽이 될 수 있다고 우려합니다. 반대로 공동 기준을 추진하는 구상에는 평가와 보고 방식을 통일하려는 목적이 담겨 있습니다. 어느 쪽의 결과가 나타날지는 제안 자체보다 기구의 권한, 참여 구조, 기준을 적용하는 방식에 달려 있을 것으로 보입니다.

크기가 다른 빈 좌석들이 놓인 회의 탁자로 참여 구조의 쟁점을 나타낸 모습

▲ 자율규제의 대표성

지금 확인할 것은 출범 여부보다 운영 범위입니다

SAFA에 관해 현재 말할 수 있는 것은 Google, OpenAI, Anthropic이 민간 주도의 안전 기준 기구를 논의한다는 점입니다. 제3자 평가, 사고 보고 절차, 자발적 안전 약속의 정의가 제안된 역할입니다. 직접 기술 평가 여부와 기존 기구와의 관계는 아직 정리해야 할 쟁점으로 남아 있습니다.

앞으로 이 논의를 볼 때에는 ‘기구가 출범했는가’와 ‘어떤 권한이 확정됐는가’를 따로 확인하는 편이 좋습니다. 특히 평가를 누가 수행하는지, 사고 보고 기준이 어떻게 정해지는지, 작은 기업과 오픈소스 진영에도 기준이 어떻게 적용되는지를 살펴봐야 합니다. 그래야 공동 안전 기준이라는 목표와 실제 작동할 조직의 모습을 구분할 수 있습니다.