OpenAI prueba cero retención, pero guarda logs hasta 30 días

OpenAI prueba cero retención, pero guarda logs hasta 30 días

OpenAI prueba Private Safety Processing, pero su API conserva logs antiabuso hasta 30 días por defecto.

Por Humberto Toledo el 19 de agosto del 2026 a las 10:11 pm PDT

✨︎ Resumen (TL;DR):

  • OpenAI prueba Private Safety Processing con clientes iniciales de API y empresariales para detectar patrones de abuso entre conversaciones relacionadas sin que su personal vea los prompts ni las respuestas.
  • La documentación de la API conserva hasta 30 días de registros antiabuso por defecto; ZDR exige aprobación previa y Anthropic aplica el mismo plazo a sus modelos cubiertos.
  • Las cuentas personales de ChatGPT y Claude quedan fuera de estas políticas. En esos planes, las conversaciones ya se guardan.

OpenAI anunció el miércoles 19 de agosto de 2026 que prueba Private Safety Processing, un sistema que busca detectar patrones de abuso entre conversaciones relacionadas sin que su personal vea los prompts ni las respuestas. La propuesta busca conservar su retención cero de datos, conocida como ZDR, para clientes aprobados de API y empresariales cuando sus modelos más capaces comiencen a encargarse de tareas largas, pero la documentación de la API establece hasta 30 días de registros antiabuso por defecto. El anuncio responde a Anthropic, que exige ese plazo para organizaciones que usen Claude Fable 5 y Claude Mythos 5, y no cambia las reglas de las cuentas personales de ChatGPT.

Agentes de OpenAI rehacen su tablón secreto tras borrarlo
Te podría interesar:
Agentes de OpenAI rehacen su tablón secreto tras borrarlo
Toma de estudio detallada de un juguete robótico moderno con fondo oscuro, mostrando un diseño tecnológico.
Foto: Pavel Danilyuk / Pexels

Private Safety Processing busca patrones, no contenido

Private Safety Processing es un sistema de seguridad que detecta patrones de abuso entre varias conversaciones relacionadas sin que el personal de OpenAI vea los prompts ni las respuestas.

Los sistemas de seguridad compatibles con ZDR evalúan cada interacción por separado. Algunos riesgos solo aparecen al conectar varias solicitudes: alguien que tantea las defensas una y otra vez, cuentas coordinadas o un agente que sigue actuando después de recibir la instrucción de detenerse.

OpenAI quiere observar esas señales a través de interacciones relacionadas. Aleah Houze, responsable de política de producto de la compañía, explicó a periodistas un ejemplo citado por Axios: alguien pregunta en una conversación por una debilidad del software de una empresa y, más tarde, en otra, pregunta por acceso remoto o por las herramientas de seguridad que podrían detectarla. Ese contexto más amplio podría ayudar a identificar un ciberataque.

En los despliegues con ZDR, el cliente mantiene los prompts y las respuestas en infraestructura bajo su control. OpenAI también desarrolla una variante en la que el contenido vive en sus propios servidores, cifrado con llaves que administra el cliente y de las que el personal de la empresa no tiene copia.

En ese diseño, cuando el sistema automatizado detecta una señal de riesgo, OpenAI recibe únicamente una señal acotada con la categoría y la gravedad de la actividad. Con esa información decide si toma medidas. El cliente investiga la alerta con sus propios registros y puede compartir material si quiere apelar la decisión o colaborar con la compañía.

Glean, Databricks, Abridge y Microsoft aparecen en el anuncio como clientes que ayudan a dar forma al esquema.

La letra pequeña de la retención cero

El anuncio no repite un dato que sí aparece en la documentación pública de la plataforma de OpenAI: todo uso de la API genera registros antiabuso y la empresa los conserva hasta 30 días por defecto. ZDR es la excepción, no el ajuste automático. Requiere aprobación previa de OpenAI, la aceptación de requisitos adicionales y una consulta con el equipo de ventas para revisar la elegibilidad.

Varios endpoints quedan fuera de ese control, entre ellos los de conversaciones, asistentes, archivos y video.

La cláusula Safety Retention añade otra reserva. OpenAI se reserva el derecho de excluir modelos de ZDR para clientes específicos cuando resulte razonablemente necesario investigar o prevenir actividad de riesgo grave. La compañía debe avisar por escrito con antelación. En ese escenario, puede conservar y someter a revisión humana el contenido que sus clasificadores marquen como posible violación de sus políticas.

Una nota al pie del anuncio establece una excepción adicional: las imágenes que los clasificadores marquen como posible material de abuso sexual infantil se conservan para revisión manual y reporte legal, incluso en despliegues con ZDR.

Brian Levine, director ejecutivo de FormerGov, lo resumió a Computerworld: “Cero nunca es del todo cero”. Levine también reconoció que la promesa técnica es fuerte, porque vigilar el abuso y no poder ver los datos han empujado históricamente en direcciones opuestas.

Anthropic fija 30 días para sus modelos cubiertos

OpenAI presentó su prueba como una respuesta a la decisión de Anthropic de exigir 30 días de retención a las organizaciones que quieran usar Claude Fable 5 y Claude Mythos 5.

La página de soporte de Anthropic acota el alcance: los 30 días aplican a los modelos cubiertos, a la clase Mythos y a los futuros modelos que la empresa designe como tales. La política está vigente desde el 9 de junio de 2026 y solo alcanza a organizaciones que ya tenían ZDR configurado en Claude Console, en Claude Code para Claude Enterprise o mediante Amazon Bedrock, Google Cloud y Microsoft Foundry.

Anthropic afirma que, por defecto, ningún empleado puede leer las conversaciones retenidas. La revisión humana solo ocurre mediante una ruta de acceso controlada cuando los sistemas automáticos marcan contenido. La realiza un grupo reducido de revisores aprobados y cada acceso queda en un registro que esos revisores no pueden borrar ni modificar.

Las organizaciones elegibles también pueden añadir llaves de cifrado administradas por ellas mismas. El contraste queda así, según la documentación pública de ambas compañías:

Punto OpenAI Anthropic
Retención por defecto Hasta 30 días de registros antiabuso en la API 30 días en los modelos cubiertos
Cómo se evita ZDR requiere aprobación previa No se evita en los modelos cubiertos
Lectura humana Excluida, salvo Safety Retention y posible material de abuso sexual infantil Solo por una ruta controlada, con revisores aprobados y registro inalterable
Llaves del cliente En desarrollo para Private Safety Processing Opción para organizaciones elegibles
Alcance Clientes aprobados de API y empresariales Organizaciones que ya tenían ZDR configurado

Anthropic escribió en un informe de riesgos citado por Axios que su decisión “será impopular entre clientes acostumbrados a la retención cero” y que supone riesgos reales para su negocio, sobre todo si sus competidores no la siguen. Aun así, la empresa la considera indispensable para detectar ataques sofisticados repartidos en muchas solicitudes. Días después, OpenAI anunció que no seguiría ese requisito.

Septiembre pondrá a prueba la arquitectura

OpenAI planea iniciar el despliegue y publicar en septiembre de 2026 un documento técnico. Ese texto permitirá comprobar qué contienen las señales acotadas, cómo operan las llaves del cliente y qué sucede con los falsos positivos. Por ahora, la compañía ha publicado la arquitectura, no ese nivel de detalle.

En otra publicación del martes 18, OpenAI informó que frenó temporalmente el ritmo de escalamiento. La medida incluyó una pausa de dos semanas en el entrenamiento por refuerzo de sus modelos más recientes destinados al despliegue, mientras la compañía endurecía y sometía a red team sus entornos de investigación.

En ese texto, OpenAI reconoció evidencia preliminar de que Astra, uno de sus modelos por venir, podría alcanzar el umbral de capacidad crítica en ciberseguridad de su Preparedness Framework. También calculó que el nuevo monitoreo costaría cerca de 20% del cómputo de inferencia vigilado; la cifra varía mucho según la carga de trabajo.

Los analistas consultados por Computerworld recibieron el anuncio con escepticismo. Jason Andersen, analista principal de Moor Insights & Strategy, habló de un poco de teatro pragmático rumbo a una salida a bolsa. También señaló que la única vía de crecimiento después de esa salida pasa por entrar más hondo en las empresas y quitarles el miedo.

Carmi Levy, analista independiente, describió la pausa de dos semanas como poco más que maquillaje para desviar las críticas. Justin St-Maurice, consejero técnico de Info-Tech Research Group, propuso una prueba concreta para cualquier comprador: pedir evidencia de lo que está contratando, no quedarse con la promesa.

TechCrunch encuadró la prueba de OpenAI como un intento de ganarle la partida a Anthropic en protecciones de privacidad y describió como tenso el ambiente entre ambas empresas. El dato comercial ayuda a entender la tensión: Anthropic superó por primera vez a OpenAI en ingresos trimestrales durante el segundo trimestre de 2026.

Las cuentas personales quedan fuera

Los controles de ZDR de OpenAI no aplican a los planes Free, Plus, Go ni Pro. Del lado de Anthropic, los planes de consumo quedaron fuera de su política de 30 días porque en ellos ya se guardan las entradas y las salidas.

Así que Private Safety Processing está dirigido a clientes aprobados de API y empresariales, no a quienes usan ChatGPT o Claude con una cuenta personal. Para esas cuentas, ninguna de estas dos políticas cambia el manejo que ya tenían las conversaciones.

La pregunta pendiente para cualquier asistente de IA es quién puede leer una consulta durante el segundo en que la máquina la responde. Proton documentó una respuesta propia y cambió el nombre de su esquema para no prometer más de lo que podía demostrar, después de descartar el cifrado homomórfico porque una sola respuesta tardaba más de un día.

OpenAI ofrece otra respuesta: la máquina lee y el personal no. El documento de septiembre permitirá comprobar qué información incluyen esas señales, cómo funcionan las llaves administradas por el cliente y qué ocurre cuando el sistema genera falsos positivos.

Fuentes: 1, 2, 3, 4, 5, 6

+ Temas Relacionados

Más de AI

Feed