OpenAI vincula a Moonshot con extracción de razonamiento

OpenAI vincula a Moonshot con extracción de razonamiento

OpenAI detectó 16,000 intentos de extraer razonamiento oculto y señaló a personas asociadas con Moonshot.

Por Humberto Toledo el 30 de septiembre del 2026 a las 7:05 pm PDT

✨︎ Resumen (TL;DR):

  • OpenAI reportó una campaña para hacer visible el razonamiento oculto de sus modelos y dijo haberla desarticulado por completo el 28 de julio.
  • Detectó 16,000 solicitudes entre el 24 y el 25 de julio, procedentes de más de 4,000 usuarios. Esos registros describen intentos, no extracciones confirmadas.
  • La empresa atribuyó un grupo central a personas asociadas con Moonshot AI, pero no publicó cuánto razonamiento se obtuvo ni los indicadores técnicos de esa atribución.

OpenAI informó el 30 de septiembre de 2026 que desactivó una campaña para obtener el razonamiento oculto de sus modelos y atribuyó un grupo central de la actividad a personas asociadas con Moonshot AI, la empresa detrás de Kimi. Detectó 16,000 solicitudes entre el 24 y el 25 de julio, procedentes de más de 4,000 usuarios, pero no confirmó cuántas extracciones tuvieron éxito ni publicó las pruebas técnicas de esa atribución.

El razonamiento oculto es un contenido de razonamiento que los modelos no muestran en su respuesta final. OpenAI describió una manipulación de conversaciones que buscaba volver visible ese contenido protegido.

Según la empresa, los operadores no rompieron su cifrado, no entraron a una base de datos ni accedieron directamente a conversaciones almacenadas de usuarios. OpenAI tampoco identificó qué modelos concretos fueron objeto de los intentos ni cuánto razonamiento pudo quedar expuesto.

OpenAI pide estándares globales para la RSI autónoma
Te podría interesar:
OpenAI pide estándares globales para la RSI autónoma
Joven profesional masculino con una actitud segura sentado en un escritorio moderno con una laptop.
Foto: Apunto Group Agencia de publicidad / Pexels

Las cifras registran intentos, no extracciones

El informe de OpenAI sitúa el inicio de la actividad el 1 de julio, cuando el volumen todavía era bajo. Tras el aumento registrado los días 24 y 25 de julio, la empresa identificó patrones relacionados en un grupo de más de 15,000 usuarios y dijo haber desarticulado por completo la campaña el 28 de julio.

Las cifras no se deben sumar. Las 16,000 solicitudes corresponden a esos dos días y proceden de más de 4,000 usuarios; los más de 15,000 usuarios se relacionan con patrones detectados en una investigación más amplia. Una nota al pie del comunicado aclara que los números describen intentos y no garantizan que la extracción funcionara.

El reporte no permite convertir esa actividad en una cifra de extracciones exitosas. OpenAI no precisó cuántas solicitudes tuvieron éxito ni cuánto razonamiento pudo quedar expuesto.

La atribución se limita a un grupo central

OpenAI reconoce que no sabe si todos los operadores observados actuaban para un mismo responsable. Su señalamiento se limita a un grupo central que atribuye a personas asociadas con Moonshot AI, la compañía detrás de Kimi. El comunicado no presenta públicamente los indicadores que permitieron llegar a esa conclusión.

CyberScoop informó que OpenAI declinó aportar más datos por razones de seguridad. El medio solicitó comentarios a Moonshot, pero la versión consultada de su artículo no incluía una respuesta.

El señalamiento tiene antecedentes, aunque este informe se refiere a una campaña concreta de julio. En septiembre, agencias de Estados Unidos incluyeron a Moonshot entre seis empresas chinas a las que acusaron de destilar modelos estadounidenses.

El Ministerio de Comercio chino rechazó entonces esas acusaciones generales por infundadas, según una cobertura anterior de FomoEra. Esa respuesta gubernamental no constituye una contestación de Moonshot al señalamiento publicado el 30 de septiembre.

La falla técnica no atribuye la campaña a Moonshot

Una investigación independiente publicada como prepublicación el 10 de agosto examinó una clase de fallas por la que bloques de razonamiento cifrado podían reutilizarse entre sesiones. OpenAI dijo que comprobó las vías reportadas por los investigadores y reforzó sus defensas.

El trabajo demuestra que el problema técnico existe, pero no atribuye la campaña de julio a Moonshot. La cantidad de contenido obtenido en los intentos descritos por OpenAI sigue sin hacerse pública.

OpenAI reforzó sus controles

OpenAI dijo que bloqueó o restringió cuentas fraudulentas, endureció los controles de registro y añadió protecciones para impedir que alguien que ya posea razonamiento cifrado de otro usuario pueda reutilizarlo para recuperar ese contenido.

También compartió información con otros laboratorios a través del Frontier Model Forum y con canales gubernamentales.

El informe documenta los intentos observados y las medidas que OpenAI afirma haber tomado. El sustento técnico de su atribución a personas asociadas con Moonshot también sigue sin hacerse público.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed