✨︎ Resumen (TL;DR):
- Un equipo de 4 integrantes de la empresa de seguridad Hacktron AI usó Claude para localizar vulnerabilidades en servidores de OpenAI.
- El equipo cobró 6,500 dólares por 72 horas de trabajo.
- La intrusión comenzó en community.openai.com y alcanzó cuentas de Slack, correos corporativos y repositorios de GitHub.
Un equipo de 4 integrantes de la empresa de seguridad Hacktron AI utilizó un modelo avanzado de Claude para encontrar vulnerabilidades en los servidores de OpenAI y escalar privilegios. El grupo cobró 6,500 dólares por 72 horas de trabajo. La operación pasó del foro community.openai.com a cuentas de Slack, correos corporativos y repositorios de GitHub. El caso pone el foco en la capacidad de los modelos de IA para apoyar la búsqueda de fallas y en el valor creciente de la ciberseguridad ofensiva.

Una imagen corrupta abrió la primera puerta
El texto identifica a 4 participantes en la operación: Harsh Jaiswal, Mohan Pedhapati, Rahul Maini y Claude, el modelo que apoyó la búsqueda de vulnerabilidades. Jaiswal, Pedhapati y Maini trabajaron con el sistema para localizar las fallas.
El equipo tomó el control de cuentas del foro de discusión de OpenAI, community.openai.com, al subir archivos corruptos de imágenes. Los archivos provocaron un desbordamiento de memoria y permitieron tomar el control de esas cuentas.
Después, los investigadores combinaron ese acceso con otra vulnerabilidad que ya estaba dentro de los servidores de OpenAI. La segunda falla les permitió escalar privilegios y acceder a cuentas de Slack, correos corporativos, repositorios de GitHub y código privado de OpenAI.
Claude Opus y Claude Fable frente a modelos anteriores
El equipo utilizó Claude Opus y Claude Fable para encontrar las vulnerabilidades. También admitió que había hecho intentos con modelos anteriores, pero esas pruebas resultaron infructuosas.
La nota plantea que pequeñas actualizaciones en modelos de frontera pueden ser suficientes para localizar fallas que los investigadores no podían encontrar meses antes. Esa es la diferencia que deja el caso: los intentos anteriores no funcionaron y las versiones mencionadas aquí sí apoyaron una intrusión con acceso a sistemas internos.
La seguridad ofensiva gana valor
La seguridad ofensiva es una práctica que busca vulnerabilidades y escala privilegios dentro de servidores. En el caso de Hacktron AI, esa labor tuvo un precio de 6,500 dólares por 72 horas.
El texto conecta el episodio con la aparición de nuevos modelos de frontera de empresas como OpenAI y Anthropic, además de Grok. También menciona Qwen, Kimi, GLM y DeepSeek, modelos chinos que podrían o no derivarse de los anteriores.
Mientras las empresas se preparan para defenderse, muchos ataques ya se realizan en automático. La nota describe la seguridad ofensiva como una de las áreas más lucrativas y presenta la ciberseguridad como una capacidad valiosa para gobiernos y empresas, además de un rubro al que ya se busca migrar.
El punto pendiente: coordinar las defensas
Mustafa Suleyman, jefe de IA de Microsoft, ha sido enfático en que las empresas del sector deben coordinarse. La razón que recoge la nota es concreta: los agentes son más autónomos, tienen más capacidad para encontrar vulnerabilidades y son más difíciles de controlar.
Los propios fundadores de empresas de IA también han expresado preocupación por el funcionamiento de sus modelos más potentes. Algunos plantean ralentizar el desarrollo; otros piden un mecanismo sólido de seguridad y confianza.
El gobierno de Estados Unidos también aparece en esta discusión. Según la nota, evalúa dar beneficios a startups dedicadas a la ciberseguridad.
El caso deja una tensión concreta: Claude ayudó a encontrar una puerta de entrada y a escalar privilegios, mientras las compañías buscan coordinar defensas frente a agentes más autónomos. El dato que ya tiene precio es claro: 6,500 dólares por 72 horas de trabajo. Esa combinación explica por qué la ciberseguridad gana peso como especialidad y como industria.
Fuente: 1
