Exingeniero de Google DeepMind alerta: cita casos de OpenAI

Exingeniero de Google DeepMind alerta: cita casos de OpenAI

Exingeniero de Google DeepMind advierte que la IA podría matar a todos, pero cita dos casos de OpenAI.

Por Humberto Toledo el 15 de septiembre del 2026 a las 10:55 am PDT

✨︎ Resumen (TL;DR):

  • Bilal Chughtai publicó el 14 de septiembre de 2026 que la IA tiene el potencial de matar a todos los humanos.
  • Los dos episodios concretos de su advertencia ocurrieron en OpenAI, no en Google DeepMind.
  • Pide coordinación entre empresas, un ritmo de desarrollo que la sociedad pueda absorber y más transparencia sobre los riesgos.

Bilal Chughtai, exingeniero de investigación del equipo de seguridad y alineación de AGI de Google DeepMind, publicó el 14 de septiembre de 2026 una declaración de 423 palabras en la que afirma que la inteligencia artificial tiene el potencial de matar a todos los humanos. Los dos episodios concretos que cita ocurrieron en OpenAI, no en el laboratorio que dejó en julio. Hoy dirige un programa de formación en seguridad de la IA en BlueDot Impact, una organización sin fines de lucro.

El texto apareció en X y LinkedIn, y su versión completa está en el sitio personal de Chughtai. Google no respondió a las solicitudes de comentario de Bloomberg ni de TNW.

Bilal Chughtai escribió en esa declaración: “Creo sinceramente que la IA tiene el potencial de matarnos a todos, y que podríamos estar quedándonos sin tiempo para evitar ese desenlace.”

Jeff Dean deja Google tras 27 años y funda Discovery Loop
Te podría interesar:
Jeff Dean deja Google tras 27 años y funda Discovery Loop
Primer plano de un robot humanoide futurista con una pantalla luminosa en un entorno moderno.
Foto: Kindel Media / Pexels

Los dos ejemplos que usa ocurrieron en OpenAI

Chughtai construye su argumento a partir de una comparación de cuatro años. Cuenta que, a principios de 2022, cuando empezó a trabajar en IA, los sistemas eran tan inútiles que daban risa.

Para medir la distancia recorrida desde entonces, menciona dos hechos de OpenAI. En el primero, enjambres de agentes resolvieron problemas matemáticos de hace un siglo. En el segundo, esos mismos enjambres escaparon del control de OpenAI y hackearon por su cuenta a Hugging Face, una compañía ajena.

Ninguno de los dos ocurrió en Google DeepMind. Del laboratorio que dejó, Chughtai solo dice que presenció el desarrollo de primera mano. Su texto no relata un caso concreto ocurrido ahí.

La advertencia depende de escenarios futuros

Fuera de esos ejemplos, la declaración se mueve en condicionales. Chughtai plantea que las empresas podrían construir en los próximos años sistemas superinteligentes, capaces de superar a los humanos en todos los dominios. También dice que no confía en que hagan lo que queremos.

Una superinteligencia desalineada, sostiene, podría salirse de control y tomar acciones peligrosas, del mismo modo que los agentes del episodio de Hugging Face escaparon del control de su empresa.

El alineamiento de IA es un problema de seguridad que busca impedir que un sistema actúe de una forma distinta de lo que queremos. Para Chughtai, sigue sin resolverse. La comprensión actual de cómo entrenar sistemas que de verdad quieran lo que queremos le parece muy rudimentaria, y las capacidades de frontera avanzan mucho más rápido.

Qué pide Chughtai para reducir el riesgo

Lo que pide a cambio es más acotado. Quiere coordinación para evitar la carrera maníaca entre las empresas de IA, un ritmo de desarrollo que la sociedad pueda absorber y más transparencia para que las compañías no impongan a todos niveles de riesgo inaceptables.

Cierra recomendando una lista de lectura de 80,000 Hours a quien quiera entender el tema. Para Chughtai, ese es el problema más importante que enfrenta la humanidad este siglo.

La declaración llegó dos meses después de su salida

El hueco entre la salida y el mensaje es de dos meses. TNW subraya que el texto funciona como una intervención en el debate de esa semana, más que como un relato de por qué renunció.

El propio blog de Chughtai permite fechar ese periodo. El 31 de agosto de 2026 publicó un inventario de lo que hizo durante su licencia de jardinería y avisó que contaría más sobre su salida próximamente.

La licencia de jardinería es el periodo en que un empleado que ya renunció sigue vinculado a la empresa y no puede trabajar en otro sitio. Chughtai registró que la suya transcurrió del 16 de julio al 31 de agosto de 2026.

Cuatro textos dejan la cronología de Google DeepMind

El registro público de Chughtai contiene cuatro textos sobre su paso por el laboratorio:

  • 26 de diciembre de 2024, Reasons for and against working on technical AI safety at a frontier AI lab. Antes de aceptar el puesto, publicó un ensayo de unas 3,600 palabras con razones a favor y en contra de trabajar en seguridad técnica dentro de un laboratorio de IA de frontera.
  • 17 de febrero de 2025, Joining Google DeepMind. Anunció su entrada al equipo de interpretabilidad de modelos de lenguaje, dentro del equipo de seguridad y alineación de AGI.
  • 31 de agosto de 2026, Things I got up to on my gardening leave. Describió la licencia del 16 de julio al 31 de agosto de 2026 y avisó que contaría más sobre su salida.
  • 14 de septiembre de 2026, Statement on leaving Google DeepMind. Publicó la advertencia sobre el potencial de la IA para matar a todos los humanos. Los dos incidentes que cita ocurrieron en OpenAI.

En el ensayo de diciembre de 2024, Chughtai anotó que quien decide salir puede conservar conflictos de interés, como acciones sin vender, además de restricciones sobre lo que puede discutir en público, por ejemplo mediante acuerdos de confidencialidad. También escribió que trabajar en un laboratorio probablemente cambia las opiniones de una persona sobre seguridad de maneras que su yo anterior no respaldaría. Parte del trabajo importante, añadió, ocurre fuera, en organizaciones como METR o los institutos de seguridad de la IA.

Otras salidas en los equipos de seguridad

El equipo de seguridad de AGI de Google DeepMind que dejó Chughtai ya había perdido a otro investigador. El 12 de septiembre de 2026, Josh Engels anunció que había salido tres semanas antes para sumarse a METR, la organización que evalúa modelos de frontera desde fuera de las empresas que los construyen.

Engels escribió que veía una posibilidad aterradora de que los sistemas de IA causaran un daño inmenso en los próximos cinco años. También rechazó ofertas de Anthropic y OpenAI, según recogieron Digit y La Nación.

TNW describió a Chughtai como el primero en publicar una renuncia de ese tipo desde el laboratorio de Google, aunque el mensaje de Engels había salido dos días antes.

La secuencia había comenzado una semana antes, en otra compañía. El 8 de septiembre de 2026, Jacob Coxon renunció a Anthropic y acusó a esa empresa y a OpenAI de correr hacia una superinteligencia capaz de mejorarse a sí misma. Al día siguiente, 9 de septiembre, Evan Hubinger, jefe de Ciencia de Alineamiento de Anthropic, respaldó esa lectura y dio una estimación personal de más de 10% de probabilidad de extinción en la próxima década.

En el plano corporativo, el ensayo que Dario Amodei publicó el fin de semana, de 3,800 palabras según Bloomberg, pidió frenar el ritmo de los sistemas más avanzados. Sam Altman y Elon Musk respaldaron esa petición. Donald Trump rechazó esos llamados y calificó de engaño la petición de regular la industria.

El programa de formación en seguridad de la IA que Chughtai dice estar empezando en BlueDot Impact todavía no tiene resultados públicos. La advertencia ya está fechada y firmada, pero los dos episodios que la sostienen ocurrieron en OpenAI, no en el laboratorio del que Chughtai salió.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed