Musk propone pruebas cruzadas de IA, pero nadie acepta

Musk propone pruebas cruzadas de IA, pero nadie acepta

Musk propone que rivales prueben modelos de IA, pero nadie acepta y el plan no tiene sanciones.

Por Humberto Toledo el 15 de septiembre del 2026 a las 9:18 pm PDT

✨︎ Resumen (TL;DR):

  • Elon Musk propuso el 14 de septiembre de 2026 que laboratorios rivales prueben los modelos de cada compañía antes de su lanzamiento público.
  • Ningún laboratorio aceptó y el esquema no incluye una autoridad con capacidad para detener un lanzamiento ni sanciones.
  • El FRONTIER Act plantea evaluadores independientes con licencia federal, acceso continuo y multas de hasta 1 millón de dólares por infracción y por día.

Elon Musk propuso el 14 de septiembre de 2026 que xAI, OpenAI, Anthropic, Google, Meta y “tres o cuatro” de las principales compañías chinas de IA se apliquen entre sí sus pruebas de seguridad antes de lanzar un modelo al público. La idea busca detectar si un modelo puede ayudar a desarrollar armas biológicas o nucleares, o engañar deliberadamente a las personas, pero ningún laboratorio ha aceptado y el esquema no incluye una autoridad ni sanciones para detener un lanzamiento.

Musk ve difícil recuperar Starship, pero ya tiene las fotos
Te podría interesar:
Musk ve difícil recuperar Starship, pero ya tiene las fotos
Reunión informal del equipo con presentación en un entorno de oficina moderna.
Foto: Matheus Bertelli / Pexels

Musk quiere cruzar las pruebas de seguridad

Musk presentó la propuesta durante el All-In Summit de Los Ángeles. En el panel participó junto a Gwynne Shotwell, presidenta y directora de operaciones de SpaceX. All-In publicó la sesión completa.

Musk usó el término “test harness” para referirse al banco de pruebas de seguridad que cada laboratorio aplica a sus propios modelos antes de publicarlos. Un test harness es un banco de pruebas de seguridad que evalúa las capacidades de un modelo antes de su lanzamiento.

Su propuesta cruza esas baterías: cada empresa aplicaría sus evaluaciones al modelo de la competencia. Musk lo resumió así: “En lugar de calificar tu propia tarea, al menos tendrías a competidores calificando tu tarea y dando la alarma si ven problemas.”

Las pruebas buscarían señales concretas, entre ellas que un modelo ayude a desarrollar armas biológicas o nucleares, o que engañe deliberadamente a las personas. Musk reconoció que no existe una solución perfecta, pero sostuvo que varias compañías evaluando los mismos sistemas tendrían muchas más probabilidades de encontrar fallas.

El esquema no obliga a ningún laboratorio

El propio Musk admitió durante la conversación que ninguno de los laboratorios había aceptado la idea. El diseño tampoco crea una autoridad capaz de detener un lanzamiento si el dueño del modelo decide ignorar la advertencia de un competidor. No establece sanciones.

El acuerdo tendría que incluir a China, una condición que Musk puso en primer plano. Dijo creer que el país estaría dispuesto a participar y que el mecanismo podría montarse rápido.

El mismo 14 de septiembre, un portavoz de la Cancillería china criticó lo que describió como “alarmismo” alrededor de la tecnología y pidió cooperación en lugar de confrontación. Pekín no se pronunció sobre el intercambio de pruebas; su respuesta pública de ese día se dirigió contra la campaña para frenar el desarrollo.

FRONTIER Act usa evaluadores con licencia

El mismo día, mientras Musk hablaba en Los Ángeles, OpenAI respaldó en Washington una disposición del FRONTIER Act, un proyecto bipartidista presentado el 23 de julio de 2026 por los representantes Jay Obernolte, republicano de California, y Lori Trahan, demócrata de Massachusetts, junto con otros cuatro legisladores.

El nombre completo del proyecto es Frontier Risk Oversight, National Transparency, Independent Evaluation, and Reporting Act. Su eje es la evaluación independiente.

Una IVO es una organización de verificación independiente, conocida por sus siglas en inglés, que recibiría una licencia federal para evaluar de manera continua a los desarrolladores de IA sujetos al proyecto.

La iniciativa plantea la figura de un subsecretario de Comercio para Seguridad de la IA, encargado de otorgar las licencias a las IVO y de supervisarlas.

El requisito alcanzaría a los desarrolladores del escalón más alto, aquellos que superen 5,000 millones de dólares de ingresos brutos y 10,000 millones de dólares en gasto de desarrollo de IA durante los 36 meses previos. Tendrían que contratar una IVO para una evaluación continua, con acceso a materiales y registros, además de evaluaciones sin censura en cualquier momento.

Si una IVO concluye que un modelo presenta un riesgo catastrófico inminente, el proyecto le ordena remitir el caso al secretario de Comercio en un plazo de 72 horas. El funcionario evaluaría una orden de emergencia para suspender o restringir el desarrollo, el despliegue o el uso interno del sistema.

El proyecto contempla multas civiles de hasta 1 millón de dólares por infracción y por día por incumplimientos de transparencia y verificación. Violar una orden de emergencia podría elevar la sanción a 10 millones de dólares por infracción y por día; si la violación es deliberada, constituiría un delito.

Además, encarga al Contralor General de Estados Unidos un informe anual al Congreso sobre el mercado de estas organizaciones, su independencia respecto de la industria de la IA y las recomendaciones para preservarla. La propuesta de Musk no contempla esa independencia: el evaluador sería el competidor directo.

Cuatro rutas, una con sanciones en el papel

Los cuatro esquemas responden a la misma pregunta, pero asignan la evaluación a actores distintos:

Propuesta Quién evaluaría Qué obliga a cumplir
Pruebas cruzadas de Musk, 14 de septiembre de 2026 Laboratorio competidor Nada acordado: ningún rival aceptó participar.
Equipos externos de Dario Amodei, 12 de septiembre de 2026 Equipo externo con acceso similar al de un empleado Nada: es una propuesta publicada en un ensayo.
Organismo de estándares de Anthropic, OpenAI y Google Organismo del propio sector Nada: todavía no existe y no tiene estatuto, financiación ni reglas acordadas sobre quién podría frenar un lanzamiento.
FRONTIER Act en la Cámara de Representantes Organizaciones de verificación con licencia federal Evaluación continua y multas civiles de hasta 1 millón de dólares por infracción y por día.

Las tres primeras opciones comparten el mismo vacío: ninguna establece una obligación legal ni un responsable con poder para detener un lanzamiento.

El 12 de septiembre de 2026, Dario Amodei, CEO de Anthropic, pidió en un ensayo que las empresas den “acceso comparable al de un empleado” a equipos capaces de verificar el cumplimiento de sus prácticas y compromisos de seguridad. Su planteamiento tampoco incluye una obligación legal.

Por su parte, Anthropic, OpenAI y Google llevan semanas explorando un organismo de estándares del sector. El organismo todavía no tiene estatuto, financiación ni reglas acordadas sobre quién podría frenar un lanzamiento.

Miranda Bogen, directora del laboratorio de gobernanza del Center for Democracy and Technology, explicó en una entrevista que los evaluadores externos pueden detectar fallas, pero no cambian la conducta de las empresas sin herramientas que acompañen el proceso.

Bogen enumeró cuatro elementos que todavía deben quedar definidos:

  • estándares de medición;
  • canales para comunicar una prueba fallida a los actores externos que correspondan;
  • obligación de corregir las deficiencias detectadas;
  • reparto claro de responsabilidades.

Sin ese conjunto, advirtió Bogen, la evaluación termina como un trámite de casilla marcada.

El proyecto con multas depende del Congreso

La vía con multas depende menos de los laboratorios y más de la política. El presidente Donald Trump rechazó esta semana las advertencias de la industria y describió la preocupación por la IA como una “farsa” y una “estafa” en publicaciones de Truth Social. Esa postura vuelve incierto el trámite de cualquier proyecto en el Congreso.

Por ahora, la propuesta que Musk puso sobre la mesa el 14 de septiembre sigue en el mismo punto: ningún laboratorio ha dicho que sí. Su mecanismo añade una revisión de competidores, pero deja sin resolver qué ocurre si el dueño de un modelo ignora la advertencia. El FRONTIER Act sí contempla una autoridad, un plazo de 72 horas y sanciones, aunque esas medidas todavía forman parte de un proyecto de ley.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed