Общество и политика Jul 14, 2026 at 22:327В закладки

Независимый орган по стандартизации, финансируемый промышленностью, который проверял бы модели перед их запуском. Предложение серьёзное. Его слепые зоны тоже.
Генеральный директор Google DeepMind предлагает создать независимый орган, который будет оценивать самые передовые модели ИИ перед их выходом на рынок. В качестве модели он приводит американский FINRA: структуру, финансируемую отраслью, которую она контролирует, но работающую автономно.
Демис Хассабис подробно описал механизм 14 июля 2026 года. Система будет внедряться постепенно: сначала добровольное участие лабораторий, которые будут делиться своими моделями с органом за 30 дней до их выпуска. В его формулировке: «Initially, Frontier Labs would voluntarily share models with the Standards Body for review up to 30 days before release». После отработки процесса оценка станет обязательной для всех развёртываний в США. Орган также будет управлять критическими уязвимостями, обнаруженными после запуска.
Контекст важен: предложение появилось после критики временных правительственных проверок моделей Mythos (Anthropic) и Sol (OpenAI), которые были сочтены технически слабыми и непрозрачными.
Делигированное саморегулирование — не новость и не аномалия. FINRA существует потому, что государственный регулятор никогда не имел ни ресурсов, ни экспертизы для мониторинга десятков тысяч брокеров в реальном времени. Она финансируется теми, кого контролирует, имеет полномочия применять санкции и работает под надзором SEC. Последний момент ключевой: саморегулирование работает только если государственный регулятор может его отменить.
Перенесённое на ИИ, это рассуждение выглядит обоснованным. Экспертиза в оценке передовых моделей сосредоточена в руках нескольких сотен человек по всему миру, почти все из которых работают в лабораториях. Независимый орган, финансируемый индустрией, возможно, единственный способ платить этим людям рыночную цену, не дожидаясь, пока государство утвердит бюджет.
Три момента, которые нужно назвать без задней мысли.
Захват. Кто назначает совет? Кто разрешает спор между органом и лабораторией, которая его финансирует? Без государственного контроля, аналогичного SEC, «независимость» — это прилагательное, а не структура.
30 дней. Окно рассчитано на аудит соответствия, а не на adversarial поиск уязвимостей. Напоминание пришло на этой неделе: IEEE Spectrum задокументировал восемь различных техник jailbreak, затрагивающих основную часть коммерческой индустрии — найдены они были не на предварительной проверке перед запуском, а постфактум, сторонними исследователями. Оценка, начинающаяся за 30 дней до релиза, будет искать то, чему её научили искать. А реальные уязвимости — это те, о которых ещё никто не подумал.
Национальный периметр. Обязательство, ограниченное развёртываниями в США, оставляет за бортом открытые модели, опубликованные в других странах — а данные Hugging Face показывают, что доля Китая в реальном использовании уже не маргинальна. Мы бы регулировали самый заметный канал, а не самый широкий.
Предложение заслуживает большего, чем циничный рефлекс «лиса, стерегущая курятник». По сравнению с импровизированными правительственными проверками, технический, финансируемый механизм с обязательным сроком — это явный прогресс.
Но история FINRA также учит, что реальная власть не в самом органе: она в государственном органе, который может его опровергнуть. Пока эта власть не названа, то, что предлагает Хассабис, — это очень хорошая лаборатория оценки. Не регулятор.
Статья создана искусственным интеллектом и проверена под редакционным контролем человека.
Войдите, чтобы участвовать в обсуждении.
Qui décide des critères de sécurité ? Et comment ?
Bonne question, mais qui contrôlera les contrôleurs pour éviter les biais ?
Qui paiera pour ces contrôles ?
Et les modèles open-source ? Comment ça les impacterait ?
30 jours de délai, c'est trop long pour l'innovation ?
Et les modèles étrangers ? 30 jours, c'est trop court pour une IA mondiale.
Bonne idée, mais qui contrôle les contrôleurs ? Risque de conflits d'intérêts.
Qui paiera pour ce contrôle ? Et les petits labos d'IA, comment feront-ils ?