✨︎ Resumen (TL;DR):
- OpenAI abrió el jueves 13 de agosto una vista previa limitada de Ultrafast, un nivel de su API que ejecuta GPT-5.6 Sol con hardware de Cerebras.
- El servicio promete hasta 750 tokens de salida por segundo, equivalentes a hasta 14 veces el nivel Standard en generación de tokens. Las tareas completas de Cerebras quedaron entre 5.6 y casi 7 veces.
- OpenAI y Cerebras no publicaron precio ni fecha de disponibilidad general. El reporte trimestral de Cerebras registra que OpenAI ejerció warrants por 10,033,508 acciones, equivalentes a 4.22% de la empresa.
OpenAI abrió el jueves 13 de agosto una vista previa limitada de Ultrafast, un nivel de servicio de su API que ejecuta GPT-5.6 Sol sobre hardware de Cerebras. La promesa es llegar a 750 tokens de salida por segundo, hasta 14 veces el ritmo del nivel Standard, usando el mismo GPT-5.6 Sol. El precio y la fecha de apertura general siguen sin publicarse.
Ultrafast es un nivel de servicio de la API de OpenAI que ejecuta GPT-5.6 Sol sobre hardware de Cerebras para entregar tokens de salida a mayor velocidad.
Ultrafast no es un modelo nuevo. OpenAI presentó GPT-5.6 Sol el 26 de junio en acceso limitado y lo liberó al público el 9 de julio.
El cambio está en la máquina que lo ejecuta. Cerebras sostiene que Ultrafast conserva la misma inteligencia que Standard y no sacrifica calidad.
El acceso comienza con un grupo reducido de clientes y una lista de espera. Ninguna de las dos empresas ha dicho cuánto costará el nuevo nivel ni cuándo estará disponible para todos.
El anuncio llegó en la misma semana en que Grok 4.6 empató con Sol en el índice de Artificial Analysis sin subir su precio por token. El lanzamiento de OpenAI pone el foco en la latencia, el tiempo que tarda el modelo en entregar una respuesta, no en una nueva versión de GPT-5.6 Sol.

El 14x mide la salida, no el tiempo total
El multiplicador de 14 veces describe la velocidad de generación una vez que el modelo comienza a escribir. No significa que una tarea completa termine 14 veces antes.
Si Ultrafast alcanza 750 tokens de salida por segundo y eso equivale a 14 veces Standard, la velocidad base implícita de Standard queda en unos 54 tokens por segundo.
Artificial Analysis, el evaluador independiente que Cerebras cita en su comunicado, registra entre 55 y 62 tokens por segundo para GPT-5.6 Sol servido por OpenAI, según la configuración de esfuerzo y la carga de entrada. En esas mediciones lo clasifica por debajo del promedio de su categoría, cercano a 68 tokens por segundo.
Cerebras publicó cuatro cifras que comparan métricas distintas:
- Velocidad de salida: hasta 14 veces, con hasta 750 tokens por segundo, al comparar Ultrafast con el nivel Standard de GPT-5.6 Sol.
- Humanity’s Last Exam: casi 7 veces, con 11 horas y 11 minutos frente a 78 horas y 27 minutos. La comparación enfrentó Ultrafast en Codex, el 10 de julio, contra Claude Fable 5 en Claude Code, entre el 13 y el 15 de julio.
- GDP-Val: 5.6 veces de extremo a extremo, al comparar GPT-5.6 Sol y su versión Ultrafast, ambos en Codex, el 31 de julio.
- Tablero financiero: 6.7 veces, con 1 minuto y 50 segundos frente a 12 minutos y 20 segundos al usar el mismo prompt en Ultrafast y Standard, según una demostración de Cerebras.
Las cuatro cifras provienen de Cerebras. Las tres que miden una tarea completa quedan entre 5.6 y casi 7 veces, un rango más cercano a lo que un cliente vería en el reloj que el máximo de 14 veces.
Las condiciones cambian entre las pruebas
Humanity’s Last Exam reúne 2,500 preguntas de nivel doctoral en áreas como química, economía y literatura. Cerebras afirma que Ultrafast respondió las 2,500 en 11 horas y 11 minutos, frente a las 78 horas y 27 minutos de Claude Fable 5, con precisión comparable.
La empresa no publicó los puntajes de precisión de ninguno de los dos sistemas.
La prueba de Ultrafast corrió con Codex en razonamiento xhigh el 10 de julio. Claude Fable 5 utilizó Claude Code, también en xhigh, entre el 13 y el 15 de julio. Los programas y las semanas fueron distintos.
La medición de GDP-Val, que arrojó 5.6 veces, se realizó el 31 de julio con razonamiento medium en ambos casos. Cerebras reportó ese resultado como una comparación de extremo a extremo.
Cerebras también afirma que Ultrafast corre 5 veces más rápido que Claude Opus 4.8 en modo Fast y 11 veces más rápido que Claude Fable 5. La empresa aclara que las cifras del lado de Anthropic provienen de las velocidades de salida reportadas por Artificial Analysis, no de corridas propias.
El precio y la apertura general siguen pendientes
El precio publicado de GPT-5.6 Sol en la API de OpenAI es de 5 dólares por millón de tokens de entrada y 30 dólares por millón de tokens de salida, según el desglose de proveedores de Artificial Analysis. Esas cifras corresponden a GPT-5.6 Sol, no a la tarifa de Ultrafast.
OpenAI, Cerebras y el blog técnico no han publicado un precio para Ultrafast ni un calendario de disponibilidad general. El formulario de espera pide la carga de trabajo, los requisitos de latencia y el uso previsto, datos propios de un perfil de cliente empresarial.
Para un desarrollador en México, España o el resto de América Latina, el acceso permanece detrás de una invitación. Ese mismo jueves, Google colocó Gemini 3.7 Flash en disponibilidad general en más de 160 países y con tarifa publicada. Ultrafast todavía depende de la lista de espera.
OpenAI ya posee 4.22% de Cerebras
La participación accionaria no apareció en los anuncios de Ultrafast. Está en la nota 17, sobre hechos posteriores, del reporte trimestral que Cerebras presentó ante la SEC el 12 de agosto, después del cierre del mercado.
El documento consigna que OpenAI ejerció parcialmente en julio un warrant y compró 10,033,508 acciones Clase N. El precio de ejercicio era de 0.00001 dólares por acción, por lo que el desembolso en efectivo rondó los 100 dólares.
Las acciones equivalen a 4.22% de los 237,564,041 títulos en circulación al 5 de agosto. Las acciones Clase N no tienen voto y se convierten una a una en Clase A cuando se transfieren. Mantienen los mismos derechos de dividendo y liquidación.
OpenAI obtuvo exposición económica a Cerebras, pero no voto en las decisiones de la compañía.
El precio de ejercicio simbólico no equivale al valor económico del paquete. El warrant nació con el acuerdo marco de diciembre de 2025 como incentivo comercial.
Cerebras valuó el warrant en 82.02 dólares por acción al otorgarlo y registró 822.9 millones de dólares en activos por warrants de cliente durante el primer semestre de 2026. La compañía amortiza ese importe como una reducción de sus propios ingresos hasta octubre de 2031.
OpenAI se comprometió a comprar 750 MW de capacidad de inferencia por un plazo de 3 o 4 años, extensible a 5. En enero, además, financió un préstamo garantizado de capital de trabajo de unos 1,000 millones de dólares, con un interés declarado de 6% anual.
OpenAI también tiene una opción sobre 1.25 GW adicionales para desplegar antes de que termine 2030. Al 30 de junio, Cerebras contabilizaba 25,400 millones de dólares en obligaciones de desempeño pendientes, con una parte importante atribuible a ese contrato.
Todavía quedan 23,411,518 acciones del warrant sin consolidar. Su entrega depende de más compras de capacidad, umbrales de capitalización o pagos del cliente.
Si OpenAI consolidara y ejerciera todas esas acciones con la base actual de títulos, su participación rondaría 12.8% y el ejercicio costaría unos 234 dólares.
Para quien no reciba la invitación, Ultrafast no cambia el acceso disponible hoy. El reporte ante la SEC sí deja clara la relación comercial: OpenAI compra cómputo de inferencia a Cerebras y ya tiene una participación económica de 4.22%; el resto del warrant depende de nuevas entregas de capacidad, umbrales de capitalización o pagos del cliente.
