Sociedad y Política Jul 14, 2026 at 22:327Añadir a favoritos

Un organismo de normalización independiente, financiado por la industria, que inspeccionara los modelos antes de su lanzamiento. La propuesta es seria. Sus ángulos muertos también.
El CEO de Google DeepMind propone crear un organismo independiente encargado de evaluar los modelos de IA más avanzados antes de su lanzamiento al mercado. El modelo que invoca es el de la estadounidense FINRA: una estructura financiada por el sector que controla, pero que funciona de manera autónoma.
Demis Hassabis detalló el mecanismo el 14 de julio de 2026. El dispositivo sería progresivo: en una primera fase, participación voluntaria de los laboratorios, que compartirían sus modelos con el organismo hasta 30 días antes de su lanzamiento. Su formulación: « Initially, Frontier Labs would voluntarily share models with the Standards Body for review up to 30 days before release ». Una vez probado el proceso, la evaluación se volvería obligatoria para cualquier despliegue en Estados Unidos. El organismo también gestionaría las vulnerabilidades críticas descubiertas después del lanzamiento.
El contexto importa: la propuesta llega tras las críticas a las revisiones gubernamentales ad hoc de los modelos Mythos (Anthropic) y Sol (OpenAI), consideradas técnicamente débiles y opacas.
La autorregulación delegada no es ni una novedad ni una aberración. La FINRA existe porque el regulador público nunca ha tenido ni los medios ni la experiencia para supervisar en tiempo real a decenas de miles de corredores. Está financiada por las entidades que controla, dispone de poder sancionador y opera bajo la supervisión de la SEC. Este último punto es decisivo: una autorregulación solo funciona si un regulador público puede desautorizarla.
Aplicado a la IA, el razonamiento se defiende. La experiencia en evaluación de modelos avanzados se cuenta con los dedos de una mano en todo el mundo, casi todos empleados por los laboratorios. Un organismo independiente financiado por la industria quizá sea la única forma de pagar a estas personas a precio de mercado sin esperar a que un Estado apruebe un presupuesto.
Tres, que hay que nombrar sin ánimo de ofensa.
La captura. ¿Quién nombra al consejo? ¿Quién arbitra un desacuerdo entre el organismo y un laboratorio que lo financia? Sin una tutela pública equivalente a la de la SEC, «independiente» es un adjetivo, no una estructura.
Los 30 días. La ventana está calibrada para una auditoría de conformidad, no para una búsqueda adversarial de fallos. El recordatorio llegó esta semana: IEEE Spectrum documentó ocho técnicas de jailbreak distintas que afectan a la mayoría de la industria comercial, encontradas no en una revisión pre-lanzamiento, sino a posteriori, por investigadores ajenos a los laboratorios. Una evaluación que comienza treinta días antes del lanzamiento buscará lo que se le ha enseñado a buscar. Los fallos que importan son aquellos en los que nadie ha pensado aún.
El perímetro nacional. Una obligación limitada a los despliegues estadounidenses deja intactos los modelos abiertos publicados en otros lugares —y las cifras de Hugging Face recuerdan que la participación china en el uso real ya no es marginal. Se regularía el canal más visible, no el más amplio.
La propuesta merece algo más que el reflejo cínico del «zorro que guarda el gallinero». Frente a revisiones gubernamentales improvisadas, un dispositivo técnico, financiado, con un plazo vinculante, es un avance neto.
Pero la historia de la FINRA también enseña que el poder real no está en el organismo: está en la autoridad pública que puede contradecirlo. Mientras esa autoridad no esté nombrada, lo que propone Hassabis es un muy buen laboratorio de evaluación. No un regulador.
Artículo producido por inteligencia artificial, revisado bajo control editorial humano.
Inicia sesión para unirte a la conversación.
Qui décide des critères de sécurité ? Et comment ?
Bonne question, mais qui contrôlera les contrôleurs pour éviter les biais ?
Qui paiera pour ces contrôles ?
Et les modèles open-source ? Comment ça les impacterait ?
30 jours de délai, c'est trop long pour l'innovation ?
Et les modèles étrangers ? 30 jours, c'est trop court pour une IA mondiale.
Bonne idée, mais qui contrôle les contrôleurs ? Risque de conflits d'intérêts.
Qui paiera pour ce contrôle ? Et les petits labos d'IA, comment feront-ils ?