✨︎ Resumen (TL;DR):
- DeepSeek avisó el 6 de agosto de 2026 que elevará de forma significativa el precio general de su API, sin revelar monto ni fecha de entrada en vigor.
- El rate card vigente de V4-Flash marca $0.14 por millón de tokens de entrada sin caché, $0.28 de salida y $0.0028 cuando la entrada ya está en caché.
- El anuncio llegó seis días después del lanzamiento de V4-Flash-0731 y se suma a un recargo de horas pico cuya fecha de inicio sigue pendiente.
DeepSeek, el laboratorio chino con sede en Hangzhou, anunció el jueves 6 de agosto de 2026 que elevará “de forma significativa” el precio general de su API. La API de DeepSeek es un servicio que permite a desarrolladores y empresas conectar sus aplicaciones con los modelos del laboratorio. La compañía no reveló cuánto cobrará, cuándo aplicará el cambio ni por qué, y publicó el aviso seis días después de lanzar V4-Flash-0731.
El aviso apareció en la página de precios de la documentación para desarrolladores. DeepSeek pidió a sus clientes que planearan el consumo con el aumento en mente, pero no incluyó porcentaje, fecha de entrada en vigor ni desglose por modelo o rubro de facturación. La empresa dijo que comunicará el esquema definitivo por separado.
Para los equipos que eligieron DeepSeek por su precio, el presupuesto del próximo trimestre quedó sin cifras. El rate card publicado es, por ahora, el único dato firme.
El momento del aviso pesa. El 31 de julio, DeepSeek liberó V4-Flash-0731 con mejor desempeño en tareas de agente y programación, y lo dejó con las mismas tarifas. El modelo había vuelto a colocar a DeepSeek como la opción más barata del mercado. Seis días después, esa misma página anunció el aumento general. No hay porcentaje, calendario ni desglose que permita saber si cambiarán por igual V4-Flash y V4-Pro o si tocarán la caché.
El desarrollador Michael Guo lo planteó en X: “Que DeepSeek elija subir precios en este momento, ¿no es buscarse problemas?” Guo sostuvo que los nuevos modelos de Meta y OpenAI ya compiten con DeepSeek tanto en capacidad como en tarifa.

La tabla vigente muestra dónde pesaría el ajuste
Después del aviso, la documentación de DeepSeek todavía lista estas tarifas en dólares por millón de tokens:
| Modelo | Entrada sin caché | Entrada con caché | Salida |
|---|---|---|---|
| V4-Flash | $0.14 | $0.0028 | $0.28 |
| V4-Pro | $0.435 | $0.003625 | $0.87 |
Ambos modelos tienen una ventana de contexto de 1 millón de tokens y una salida máxima de 384K. La documentación también lista límites de concurrencia de 2,500 y 500 peticiones.
La caché de tokens es una modalidad de entrada que aplica una tarifa menor cuando el texto ya está almacenado para reutilizarse. Artificial Analysis ubicó los $0.0028 de V4-Flash como el precio más bajo entre 101 modelos de su clase, 98% por debajo de la tarifa de entrada sin caché del propio modelo.
Un prompt de sistema fijo o un documento largo reutilizado puede aprovechar esa tarifa muchas veces. Si el alza general toca la caché, los proyectos de alto volumen sentirán primero el cambio, no las consultas sueltas.
El gasto de salida añade otra presión. V4-Flash razona antes de responder y, en las mediciones de Artificial Analysis, gastó 210 millones de tokens de salida para completar su Intelligence Index, frente a una mediana de 100 millones. Con el precio vigente, completar esa batería costó $72.02.
Por eso, una tarifa de salida más alta tendría un efecto mayor en cargas que generan respuestas largas, aunque el precio por token de entrada se mantenga bajo.
El recargo de horas pico es otra medida
DeepSeek tiene dos cambios de precio pendientes y conviene separarlos. En julio anunció una política de tarifas pico y valle que duplicará el costo de todos los rubros de facturación durante dos franjas diarias de Pekín: de 9:00 a 12:00 y de 14:00 a 18:00. La documentación indicó que avisaría después la fecha de inicio, pero todavía no la publica.
En España, esos bloques comienzan a las 3:00 y 8:00 de la mañana; el segundo cubre media jornada laboral en Madrid. En Ciudad de México caen entre las 7:00 de la noche y las 4:00 de la madrugada, fuera del horario de oficina. Un equipo mexicano que programe el batch de madrugada puede evitar el doble cobro.
El aumento general avisado el 6 de agosto de 2026 es distinto: aplicará a la API y llegará con su propio comunicado. El recargo por horario todavía carece de fecha, igual que la subida general.
El precio por token ya enfrenta rivales
Durante año y medio, DeepSeek construyó su reputación global alrededor de tarifas que podían costar centavos. El 30 de julio, OpenAI recortó GPT-5.6 Luna a $0.20 de entrada y $1.20 de salida por millón de tokens.
Meta lanzó Muse Code con dos niveles. El estándar cuesta $1.25 de entrada y $4.25 de salida; el segundo baja a $0.10 y $0.20 para quienes acepten que sus datos entrenen al agente. Las cifras del Wall Street Journal fueron citadas por el analista M.G. Siegler. Con ese nivel condicionado, Meta cobra menos que V4-Flash por token.
Por tarea de referencia, los cálculos de Artificial Analysis ponen los costos así:
- V4-Flash: $0.03 por tarea.
- Kimi K3 de Moonshot AI: $0.86.
- GPT-5.6 Sol de OpenAI: $1.86.
- Claude Fable 5 de Anthropic: $3.15.
V4-Flash sigue por debajo de esos modelos cuando se calcula el trabajo completo, aunque Meta ya ofrece un nivel con menor costo por token. Esa diferencia explica por qué el alza anunciada puede presionar presupuestos incluso antes de conocer el nuevo rate card.
DeepSeek no explicó el motivo del aumento
DeepSeek no dio una razón oficial. El South China Morning Post vinculó el aviso con la demanda global que provocó el nuevo modelo, pero esa lectura no confirma que una saturación de cómputo haya causado el ajuste. Tampoco se sabe si la subida será igual para Flash y Pro ni qué pasará con el precio de la caché.
El contexto financiero suma otra pieza. The Information reportó que DeepSeek reanudó su segunda ronda de financiamiento, pausada por más de una semana después de filtrarse la transcripción de una llamada confidencial entre el fundador Liang Wenfeng y sus inversionistas. Esta semana circuló un nuevo term sheet entre ellos.
Ese reporte añade contexto temporal, pero no una explicación oficial del incremento.
La API alojada no es la única salida
El alza anunciada solo alcanza al servicio de API alojado por DeepSeek. Los pesos de V4-Flash-0731 se distribuyen bajo licencia MIT, permiten descargar el modelo, ejecutarlo en infraestructura propia y usarlo comercialmente.
Artificial Analysis registra seis proveedores externos que ya sirven ese modelo, además de la API de DeepSeek. Quien lo corra por cuenta propia fija el gasto con el hardware y la infraestructura que utilice; quien dependa del servicio alojado tendrá que esperar la nueva tabla.
Mientras no llegue la notificación oficial, las tarifas verificables siguen siendo las actuales: V4-Flash cobra $0.14 por millón de tokens de entrada sin caché, $0.0028 con caché y $0.28 de salida; V4-Pro, $0.435, $0.003625 y $0.87, respectivamente. El documento que falta tendrá que precisar el monto o porcentaje, la fecha de inicio y el tratamiento de la caché. Hasta entonces, el costo por tarea de V4-Flash, medido hoy en $0.03, no puede calcularse con una tarifa nueva que todavía no existe.
