사회 및 정책 Jul 14, 2026 at 22:327북마크에 추가

독립적인 표준화 기구로, 산업계의 자금 지원을 받아 출시 전 모델을 검사하는 기관입니다. 이 제안은 진지합니다. 하지만 이 제안에도 blind spot(사각지대)이 있습니다.
구글 딥마인드 CEO가 시장에 출시되기 전 가장 진보된 AI 모델을 평가할 독립 기구를 설립할 것을 제안했습니다. 그가 언급한 모델은 미국의 FINRA입니다. 이는 해당 업계가 자금을 대지만 독립적으로 운영되는 구조입니다.
Demis Hassabis는 2026년 7월 14일 메커니즘을 자세히 설명했습니다. 이 시스템은 점진적으로 도입될 예정입니다. 우선, 연구실들이 자발적으로 모델을 기구에 공유하여 출시 30일 전까지 검토를 받을 수 있습니다. 그의 설명에 따르면, 「Initially, Frontier Labs would voluntarily share models with the Standards Body for review up to 30 days before release」입니다. 일단 이 과정이 검증되면, 미국 내 모든 배포는 의무적으로 평가를 받아야 합니다. 이 기구는 또한 출시 후 발견된 주요 취약점도 관리할 것입니다.
이 제안은 사전 정부 검토가 약하고 비투명하다는 평가를 받은 Mythos(Anthropic)와 Sol(OpenAI) 모델에 대한 비판 이후 등장했습니다.
위임된 자율 규제는 새로운 개념도, 이상 현상도 아닙니다. FINRA는 공공 규제 기관이 실시간으로 수만 명의 브로커를 감시할 수 있는 전문성이나 자원을 갖추지 못했기 때문에 존재합니다. FINRA는 규제 대상인 업계로부터 자금을 받고, 제재 권한을 가지며, SEC의 감독 아래 운영됩니다. 중요한 점은 공공 규제 기관이 자율 규제를 거부할 수 있어야 한다는 것입니다.
AI로 이 개념을 적용하면 타당해 보입니다. 최첨단 모델 평가 전문가는 전 세계에 몇백 명에 불과하며, 대부분 연구실에서 근무합니다. 업계가 자금을 대는 독립 기구가 이들을 시가대로 채용할 수 있는 유일한 방법일 수 있습니다. 정부가 예산을 승인할 때까지 기다릴 필요가 없습니다.
세 가지 blind spot을 지적합니다. 악의적 의도는 없습니다.
포획(capture). 누가 이사회를 임명합니까? 기구와 기금을 대는 연구실 간 분쟁을 누가 조정합니까? SEC와 같은 공공 감독이 없다면 「독립적」이라는 단어는 구조가 아니라 형용사에 불과합니다.
30일. 이 기간은 규정 준수 감사에 맞춰져 있으며, 취약점 발견을 위한 adversarial 검색에는 맞지 않습니다. 이번 주에 IEEE Spectrum이 주요 상용 AI 산업에 영향을 미치는 8가지 jailbreak 기술을 문서화했습니다. 이 기술들은 사전 검토가 아닌, 연구실 외부 연구자들에 의해 사후에 발견되었습니다. 출시 30일 전부터 시작되는 평가는 지시받은 것만을 찾습니다. 아무도 생각하지 못한 취약점이 바로 중요한 문제입니다.
국가적 범위. 미국 내 배포에만 의무를 부과하면, 해외에서 공개된 오픈 모델(예: 중국어 모델)은 규제 대상에서 제외됩니다. 허깅페이스(Hugging Face)의 통계에 따르면, 실제 사용량에서 중국어 점유율은 더 이상 무시할 수 없습니다. 가장 눈에 띄는 채널만 규제하고, 가장 넓은 채널은 규제하지 않는 셈입니다.
이 제안은 「여우가 닭장을 지키는」식의 냉소적 반응보다 더 나은 평가를 받아야 합니다. 즉흥적인 정부 검토에 비해, 기술적이며 자금이 뒷받침되고 엄격한 기한을 지닌 시스템은 분명한 진전입니다.
하지만 FINRA의 역사에서 배울 점은 실제 권한이 기구에 있지 않다는 것입니다. 권한은 기구를 반대할 수 있는 공공 기관에 있습니다. 이 공공 기관이 명시되지 않는 한, Hassabis의 제안은 훌륭한 평가 실험실일 뿐입니다. 규제 기관은 아닙니다.
인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.
Qui décide des critères de sécurité ? Et comment ?
Bonne question, mais qui contrôlera les contrôleurs pour éviter les biais ?
Qui paiera pour ces contrôles ?
Et les modèles open-source ? Comment ça les impacterait ?
30 jours de délai, c'est trop long pour l'innovation ?
Et les modèles étrangers ? 30 jours, c'est trop court pour une IA mondiale.
Bonne idée, mais qui contrôle les contrôleurs ? Risque de conflits d'intérêts.
Qui paiera pour ce contrôle ? Et les petits labos d'IA, comment feront-ils ?