ICT·바이오 오픈AI·앤트로픽·메타, AI 안전도 '감사' 받는다···이사회까지 책임 확대

ICT·바이오 ICT일반

오픈AI·앤트로픽·메타, AI 안전도 '감사' 받는다···이사회까지 책임 확대

등록 2026.10.03 09:09

유선희

  기자

그래픽=박혜수 기자그래픽=박혜수 기자

인공지능(AI) 안전성 관리가 기업 내부 점검을 넘어 외부 감사와 이사회 감독으로 확대되고 있다. 오픈AI·앤트로픽·구글·메타·엔비디아·xAI 등 주요 AI 기업들이 프런티어 AI의 안전성을 점검하기 위한 공동 자율 원칙에 합의하면서다.

3일(현지시간) 주요 외신에 따르면 최근 6개 기업은 미국 백악관에서 '프런티어 책임에 관한 공동 약속(Joint Commitment on Frontier Responsibilities)'에 서명했다. 합의문은 프런티어 모델을 개발·배포하는 기업이 AI의 안전성을 확보하기 위해 내부 통제부터 외부 평가까지 단계적인 관리 체계를 마련하도록 하는 내용을 담았다.

이번 협약에 참여한 기업들은 우선 AI 모델의 개발·배포 과정에서 사이버보안·바이오보안·화학 분야 위험을 점검하는 내부 통제 절차를 마련해야 한다. AI가 의도하지 않은 방식으로 시스템에 접근하거나 해킹하는 등 행위를 방지하는 내용도 포함됐다. 아울러 별도의 내부 전담 조직이 안전성 통제와 모니터링이 제대로 작동하는지 확인하고 독립적인 외부 평가기관을 통해 다시 검증하는 구조다. 외부 평가기관은 AI 기업의 안전성 통제와 위험 탐지 체계가 실제로 의도한 대로 작동하는지를 평가하게 된다.

특히 최종적인 감독 책임을 이사회에 부여한 점이 눈에 띈다. 각 기업은 이사회 내 독립위원회를 두고 내부 조직과 외부 평가기관의 보고를 받아 문제 해결 여부를 감독해야 한다. AI 안전성을 개발 조직이나 별도 안전성 조직의 업무에만 맡기지 않고 기업의 의사결정 구조 안으로 끌어들인 셈이다.

이번 합의에는 기업들이 정기적으로 만나 AI 안전성 기준과 모범사례를 마련하는 내용도 담겼다. 향후 합의 내용을 법률이나 규제로 구체화할 필요가 있을 수 있다는 내용도 포함됐다.

다만 현재로서는 법적 구속력이 없는 자율협약이다. 외부 평가기관을 누가 선정할지나 평가 결과를 어느 수준까지 공개할지 등에 대한 구체적인 의무도 정해지지 않았다. 외부 평가를 도입하더라도 기업이 평가 방식과 범위를 상당 부분 결정할 수 있다는 점에서 실효성을 둘러싼 지적도 나온다.

AI 안전성 관리의 중요성이 커지는 가운데 기업 내부의 자체 평가에 더해 외부 검증과 이사회 차원의 감독까지 요구하는 흐름이 나타나고 있다는 점에서 이번 합의가 주목된다. 특히 AI 에이전트처럼 이용자를 대신해 외부 시스템에 접근하고 실제 행동을 수행하는 서비스가 확산하면서 모델의 성능뿐 아니라 통제 장치가 제대로 작동하는지 확인하는 절차도 중요해지고 있다.

ad

댓글