DeepSeek V4-Pro: el caché subirá hasta 12 veces

DeepSeek V4-Pro: el caché subirá hasta 12 veces

DeepSeek V4-Pro elevará hasta 12 veces el precio del caché desde el 16 de agosto de 2026.

Por Humberto Toledo el 13 de agosto del 2026 a las 11:41 am PDT

✨︎ Resumen (TL;DR):

  • DeepSeek puso V4-Pro-0813 en disponibilidad general el 12 de agosto de 2026, sin blog, reporte técnico ni comunicado.
  • La salida de la API pasará de 0.87 a 3.96 dólares por millón de tokens en horario pico; el caché subirá de 0.003625 a 0.044 dólares.
  • Las pruebas externas muestran una brecha: Vals AI midió 54.68% en Terminal-Bench 2.1 frente al 87.9 de DeepSeek, aunque el modelo alcanzó 96.40% en SWE-bench Verified.

DeepSeek puso en disponibilidad general su modelo insignia DeepSeek-V4-Pro-0813 el 12 de agosto de 2026 y cambiará los precios de su API el domingo 16 de agosto a las 16:00 UTC. La empresa explicó el esquema por horario como una forma de asignar sus recursos de manera más razonable: la salida pasará de 0.87 a 1.98 dólares por millón de tokens fuera de pico y a 3.96 en pico, mientras la entrada desde caché subirá de 0.003625 a 0.044 dólares.

DeepSeek-V4-Pro es un modelo de IA que responde desde la API de DeepSeek; la empresa lo presentó como su modelo insignia.

El alto costo de la IA obliga a las empresas a migrar al código abierto
Te podría interesar:
El alto costo de la IA obliga a las empresas a migrar al código abierto
Vista de dron de un barco en aguas turquesa cerca de Bari, Italia. Colores vibrantes y perspectiva única.
Foto: K / Pexels

La factura cambia según la hora

DeepSeek empezó a servirlo en el endpoint deepseek-v4-pro. No hubo entrada de blog, reporte técnico ni comunicado: la señal fue un cambio de versión en la página de precios de la API.

La tarifa inicial fijó la entrada sin caché en 0.435 dólares por millón de tokens y la salida en 0.87. El contraste que circuló ese día fue Claude Fable 5 de Anthropic, que cobra 50 dólares por esa misma medida.

Hasta las 16:00 UTC del domingo 16 de agosto de 2026, DeepSeek mantendrá esos precios. Después, la API tendrá una franja pico y otra económica. En la franja cara, la salida costará 3.96 dólares, 4.5 veces la tarifa de 0.87.

Todos los valores de la tabla están expresados en dólares por millón de tokens:

Partida Vigente hasta 16:00 UTC del 16 de agosto de 2026 Fuera de pico Pico
Entrada sin caché $0.435 $0.66 $1.32
Entrada desde caché $0.003625 $0.022 $0.044
Salida $0.87 $1.98 $3.96

DeepSeek fijó el horario pico entre 01:00 y 04:00 UTC y entre 06:00 y 10:00 UTC. El resto del día queda como franja económica, con una tarifa equivalente a la mitad del precio pico. Según recogió Bloomberg, la empresa presentó el cambio como una forma de asignar recursos de manera más razonable y empujar el trabajo que no corre prisa hacia las horas menos congestionadas.

El ajuste va desde un aumento de 52% en la entrada más barata hasta más de 1,100% en la entrada desde caché durante el pico. El caché, la partida que sostiene la economía de los agentes, concentra el golpe.

Hasta ahora, un token repetido costaba 120 veces menos que uno nuevo. Desde el domingo costará solo 30 veces menos. Para un agente que relee los mismos archivos decenas de veces por tarea, cada repetición pesa mucho más en la factura.

El modelo pequeño de la casa, V4-Flash, recibirá el mismo trato: su salida pasará de 0.28 a 1.32 dólares por millón de tokens en horario pico. La subida del caché repite un movimiento visto días antes, cuando Grok 4.6 igualó a GPT-5.6 Sol sin cambiar su precio por token y con el caché subiendo de 0.30 a 0.50 dólares.

México queda en la franja económica

Las ventanas caras de DeepSeek coinciden con el horario de oficina en Pekín, de 09:00 a 12:00 y de 14:00 a 18:00. En UTC, la empresa las fijó de 01:00 a 04:00 y de 06:00 a 10:00; el resto del día es económico.

En Ciudad de México, el pico cae de 19:00 a 22:00 y de la medianoche a las 04:00. En Tijuana, cada ventana ocurre una hora antes. Toda la jornada laboral mexicana queda en la tarifa barata, pero los procesos nocturnos pagan el doble.

En España sucede lo contrario. Con Madrid en UTC+2, el pico cubre de 08:00 a 12:00, justo la mañana de oficina, además de una ventana de madrugada de 03:00 a 06:00.

El cambio entra en vigor a las 10:00 del domingo en Ciudad de México, a las 09:00 en Tijuana y a las 18:00 en Madrid. En Pekín serán las 00:00 del lunes 17 de agosto, razón por la que parte de la cobertura fechó el ajuste un día después.

DeepSeek avisó el alza el 6 de agosto

La empresa había advertido el 6 de agosto que subiría sus precios, aunque no dio cifras ni fecha. Bloomberg reportó que DeepSeek está en medio de una ronda de financiamiento grande y ya empezó a preparar una salida a bolsa que podría llegar este mismo año, en 2026.

Según ese reporte, Liang Wenfeng, fundador de DeepSeek, enfrenta por primera vez la necesidad de equilibrar las expectativas de los inversionistas con el costo de construir infraestructura de cómputo.

Un lanzamiento sin reporte técnico

El estreno no tuvo página de anuncio. El desarrollador Simon Willison, que documenta los lanzamientos de modelos, tuvo que enlazar a OpenRouter porque no encontró una publicación oficial.

Las cifras aparecieron primero en el grupo oficial de DeepSeek en WeChat. Alguien las copió en Reddit, donde los moderadores borraron el post por estar poco elaborado, y después terminaron en una tabla de arte ASCII en Hacker News. South China Morning Post reportó que una breve declaración aparecida en el sitio oficial el miércoles ya había desaparecido para la tarde del jueves.

Los benchmarks dejan una brecha de 33 puntos

La tabla que circuló comparó el modelo nuevo con el preview de abril de DeepSeek:

Prueba Preview de abril V4-Pro
DeepSWE 12.8 62.7
Terminal-Bench 2.1 72.1 87.9
CyberGym 52.7 83.3
AutomationBench 12.8 31.8

Todas las comparaciones enfrentan V4-Pro con la versión previa de la propia empresa, no con un rival.

Las evaluaciones externas dieron otra lectura. En el Artificial Analysis Intelligence Index, V4-Pro pasó de 45 a 53 y empató con GLM-5.2 de Zhipu. Quedó 4 puntos debajo de GPT-5.6 Terra de OpenAI y 7 debajo de Kimi K3 de Moonshot.

Vals AI, la firma de San Francisco que corre sus propias evaluaciones, colocó a V4-Pro en el puesto 12 de su índice con 66.25%, más de 10 puntos por encima de la versión anterior.

El choque más fuerte aparece en Terminal-Bench 2.1. Vals corrió la prueba tres veces completas y colocó a V4-Pro en el puesto 33 de 52 modelos con 54.68%. En las tareas difíciles, el modelo marcó 28.89%. DeepSeek reporta 87.9 en esa misma prueba. La diferencia es de 33 puntos, justo en el resultado que la empresa usó como titular de su tabla.

En modelado financiero en Excel, Vals obtuvo 52.80% y el puesto 24 de 37.

Código destacado, auditoría con menor precisión

Donde V4-Pro sí sobresalió fue en SWE-bench Verified. Quedó segundo entre 82 modelos con 96.40%, el mejor resultado entre los modelos de peso abierto, por delante de Kimi K3 y a menos de un punto de Claude Opus 5. El costo reportado fue de 0.02 dólares por prueba para V4-Pro, frente a 1.29 dólares para Opus 5.

La firma belga de seguridad Aikido lo probó en su banco de vulnerabilidades. Philippe Dourassov publicó que V4-Pro redescubrió 87.5% de los CVE del ejercicio en la tercera pasada, por encima del 81.3% de Claude Opus 5 y Qwen 3.8.

Sin embargo, solo 65.6% de lo que reportó era una vulnerabilidad real, lejos del 86.4% de GPT-5.6 Sol. Dourassov lo describió como un modelo potente para encontrar fallas profundas, pero poco fiable para una auditoría exhaustiva.

El build 0813 todavía no está disponible

DeepSeek aún no publica los pesos del build 0813. El repositorio de la empresa en Hugging Face todavía muestra la versión preview de abril, así que quien hoy corre V4-Pro en infraestructura propia no está ejecutando el mismo modelo que responde en la API.

Para quien use la API desde México, el horario define el costo real: la jornada laboral cae en la tarifa económica y los procesos nocturnos entran en la franja pico. Para quien quiera alojar el modelo por su cuenta, los pesos del build 0813 siguen siendo el pendiente inmediato. La otra tensión queda en Terminal-Bench 2.1: Vals AI obtuvo 54.68% y DeepSeek publica 87.9.

Fuentes: 1, 2, 3, 4, 5, 6

+ Temas Relacionados

Más de AI

Feed