✨︎ Resumen (TL;DR):
- OpenAI lanzó GPT-6 Sol y GPT-6 Luna, dos modelos más rápidos y baratos con tarifas de API 50% menores que GPT-5.6.
- La empresa reporta alrededor de la mitad de errores para Sol; en sus niveles de esfuerzo más altos, Luna iguala la fiabilidad de GPT-5.6 Sol por cerca de 1% del costo.
- Anthropic presentó Opus 5.5 unos 90 minutos antes y cambió la comparación de precios el mismo día.
OpenAI lanzó GPT-6 Sol y GPT-6 Luna, dos modelos más rápidos y baratos que amplían la generación GPT-6 junto con Astra, su modelo insignia estrenado a inicios de septiembre. La compañía redujo 50% el precio de acceso por API frente a GPT-5.6 y asegura que sus modelos cometen menos errores. La afirmación se apoya en pruebas internas, mientras Anthropic bajó el precio de Opus 5.5 unos 90 minutos antes.
El anuncio combina la rebaja con cifras propias de OpenAI sobre precisión. La empresa afirma que Sol se equivoca alrededor de la mitad que su antecesor, mientras Luna iguala la fiabilidad de GPT-5.6 Sol en sus niveles de esfuerzo más altos por cerca de 1% de su costo.
GPT-6 Sol es un modelo de IA que permite a quienes programan usar sus capacidades mediante la API de OpenAI y dentro de Codex y ChatGPT Work. GPT-6 Luna es un modelo de la misma generación que OpenAI también habilita en la app de escritorio para cuentas gratuitas y Go.

La API baja a la mitad frente a GPT-5.6
OpenAI atribuye el recorte a mejoras en el almacenamiento en caché y la inferencia. También ofrece límites de uso más altos. La empresa aclara que las tarifas de la serie GPT-5.6 eran promocionales y que estos nuevos precios son los de referencia.
Estos son los precios por millón de tokens, en dólares, con entrada y salida en ese orden:
| Modelo | GPT-5.6, entrada / salida | GPT-6, entrada / salida |
|---|---|---|
| Sol | $4 / $20 | $2 / $10 |
| Luna | $0.20 / $1.20 | $0.10 / $0.50 |
No existe por ahora una versión GPT-6 Terra, el modelo intermedio de la familia.
OpenAI reporta menos errores, con una prueba interna
OpenAI basó su comparación en una evaluación interna de precisión factual. El conjunto reúne conversaciones reales anonimizadas en las que los usuarios habían marcado un error.
Según la compañía, GPT-6 Sol comete alrededor de la mitad de fallos que GPT-5.6 Sol y se acerca a la precisión factual de Astra con un costo mucho menor. En sus niveles de esfuerzo más altos, GPT-6 Luna iguala la precisión factual de GPT-5.6 Sol por aproximadamente la centésima parte del costo de GPT-5.6 Sol, cerca de 1%.
OpenAI advierte que la evaluación parte de conversaciones diseñadas para provocar errores y no refleja el uso típico, donde los fallos son más raros. Además, el anuncio no incluyó un juego completo de resultados de referencia antes de su publicación.
Las pruebas de seguridad no mejoran por igual
Las métricas de seguridad cambian según la prueba:
- “engaño en código”: la métrica de GPT-6 Sol bajó a 1.3% desde 10.4%.
- “acceso denegado”: cuando los investigadores le pidieron a Sol respetar una advertencia explícita con esa frase, el modelo siguió intentando saltarse la restricción en 64.4% de los intentos, frente a 68.2% de la versión previa. Luna mejoró más: bajó a 42.4% desde 78.5%.
OpenAI precisa que estas pruebas cubren situaciones de bajo riesgo y se ejecutan sin las salvaguardas de sus productos.
La comparación con Anthropic quedó desfasada
OpenAI también comparó sus modelos con Anthropic usando el costo por tarea, no solo el precio por token. En la prueba AutomationBench, centrada en flujos de trabajo empresariales, la compañía afirma que GPT-6 Sol con esfuerzo alto supera a Claude Opus 5 en su nivel máximo con un costo por tarea de apenas 9% del de ese modelo.
En DeepSWE, una prueba de ingeniería de software, OpenAI sitúa a Sol a 1.1 puntos del mejor resultado de Claude Fable 5 y calcula un costo por tarea cerca de 80% menor.
Esa comparación perdió vigencia el mismo día. Anthropic lanzó una nueva versión de Opus 5.5 unos 90 minutos antes y bajó su tarifa por token a $4 de entrada y $20 de salida, desde $5 y $25.
Eso deja a Opus 5.5 al doble del precio de GPT-6 Sol por token. Anthropic sostiene que su modelo usa menos tokens por tarea, lo que, según la empresa, se traduce en costos 40% menores que Opus 5 en cargas habituales.
Todavía no existe una medición de Sol y Opus 5.5 frente a frente. Como resulta casi imposible saber cuántos tokens gastará un agente para terminar una tarea, ninguna de las dos rebajas resuelve por sí sola el presupuesto final.
Dónde puedes usar GPT-6 Sol y Luna
Desde hoy, GPT-6 Sol y GPT-6 Luna están disponibles en ChatGPT Work y Codex para los planes Plus, Pro, Business, Enterprise y Edu. Las cuentas gratuitas y las del plan Go pueden probar Luna en la app de escritorio.
Todavía ninguno de los dos aparece en el modo Chat. En la API, los modelos se identifican como gpt-6-sol y gpt-6-luna.
OpenAI los distribuirá gradualmente durante el día para no saturar el servicio, así que pueden tardar en aparecer. Para quien programa, el cambio inmediato está en el precio de los tokens y en el margen adicional para iterar, no en un salto de capacidad.
Aún falta una comparación directa entre Sol y Opus 5.5; hasta que exista, la tarifa por token no basta para calcular cuánto costará completar una tarea.
