社会と政策 Jul 14, 2026 at 22:327ブックマークに追加

独立した産業界が資金を提供する規格団体が、モデルの発売前に検査を行うという提案は真剣に検討されている。しかし、その盲点も存在する。
Google DeepMindのCEOは、市場に投入される前に最先端のAIモデルを評価する独立機関の設立を提案しています。彼が提案するモデルは、米国のFINRA(金融業界規制機関)のような、業界が資金を提供する一方で自律的に機能する構造です。
Demis Hassabisは2026年7月14日にその仕組みを詳述しました。この仕組みは段階的に導入される予定です。まず、ラボが自主的にモデルを機関に共有し、リリースの30日前までにレビューを受けるという任意参加から始まります(「当初は、フロンティアラボが自主的にモデルを基準団体にリリースの30日前まで共有する」)。プロセスが確立されれば、米国での展開に関しては評価が義務化されます。また、機関はリリース後の重大な脆弱性も管理します。
背景には、技術的に不十分で不透明とされたMythos(Anthropic)やSol(OpenAI)といったモデルの政府によるアドホックなレビューに対する批判があります。
委任された自主規制は、新しい概念でも異例なことでもありません。FINRAが存在するのは、公的規制当局が数万人のブローカーをリアルタイムで監視するリソースも専門知識も持っていないからです。FINRAは監督対象の業界から資金を得ており、制裁権を持ち、SECの監督下で運営されています。この最後の点が決定的です:自主規制が機能するのは、公的規制当局がそれを否定できる場合のみです。
AIにこの考えを当てはめると、理にかなっています。最先端モデルの評価に関する専門知識を持つ人は世界で数百人しかおらず、そのほとんどがラボに雇用されています。業界が資金を提供する独立機関は、国家が予算を承認するのを待つことなく、これらの専門家に市場価格で報酬を支払う唯一の方法かもしれません。
3つの盲点を指摘しておく必要があります。
利益相反。誰が理事会を任命するのか?機関とそれを資金提供するラボとの間で意見の相違が生じた場合、誰が仲裁するのか?SECに相当する公的監督がなければ、「独立」は形容詞に過ぎません。
30日間。この期間は、コンプライアンス監査には適していますが、敵対的な脆弱性調査には不向きです。今週発表されたリマインダーでは、IEEE Spectrumが jailbreak(回避)技術8種類を文書化しており、これらは商業用AIの大半に影響を与えます。これらの脆弱性は、リリース前のレビューではなく、ラボ外の研究者によって事後的に発見されました。リリース30日前から始まる評価は、教えられたことしか探しません。本当に重要な脆弱性は、まだ誰も思いついていないものです。
国家の枠組み。米国への展開に限定された義務では、海外で公開されるオープンモデル(Hugging Faceのデータによると、中国の実使用シェアはもはや無視できません)は規制されません。最も目に見えるチャンネルを規制するだけで、最も広いチャンネルは規制されないのです。
この提案は、鶏を守るキツネのような皮肉な反応に値するものではありません。政府による即席のレビューに比べれば、技術的な基準を持ち、資金が提供され、厳格な期限が設けられたこの仕組みは明らかな進歩です。
しかし、FINRAの歴史が教えるように、真の権力は機関自体にはありません。それは機関を否定できる公的権威にあります。その権威が明確にされない限り、Hassabisの提案は優れた評価ラボにはなりますが、規制当局にはなりません。
本記事は人工知能により作成され、人間の編集管理のもとで校閲されています。
Qui décide des critères de sécurité ? Et comment ?
Bonne question, mais qui contrôlera les contrôleurs pour éviter les biais ?
Qui paiera pour ces contrôles ?
Et les modèles open-source ? Comment ça les impacterait ?
30 jours de délai, c'est trop long pour l'innovation ?
Et les modèles étrangers ? 30 jours, c'est trop court pour une IA mondiale.
Bonne idée, mais qui contrôle les contrôleurs ? Risque de conflits d'intérêts.
Qui paiera pour ce contrôle ? Et les petits labos d'IA, comment feront-ils ?