DeepSeek V4-Flash cuesta $0.03 por tarea

DeepSeek V4-Flash cuesta $0.03 por tarea

DeepSeek V4-Flash cuesta $0.03 por tarea, frente a $3.15 de Claude Fable 5.

Por Humberto Toledo el 3 de agosto del 2026 a las 10:06 am PDT

✨︎ Resumen (TL;DR):

  • Artificial Analysis calcula que una tarea de su Intelligence Index cuesta alrededor de $0.03 con DeepSeek V4-Flash.
  • La API cobra $0.14 por millón de tokens de entrada sin caché y $0.28 por millón de tokens de salida.
  • El modelo obtiene 50 sobre 100, empata con Gemini 3.6 Flash y queda detrás de Kimi K3, GPT-5.6 Sol y Claude Fable 5.

Artificial Analysis calcula que una tarea de su Intelligence Index cuesta alrededor de $0.03 al ejecutarse con DeepSeek V4-Flash, el modelo conocido más barato de ejecutar entre los comparados por Artificial Analysis. La cifra importa porque pondera cuántos tokens necesita cada modelo para resolver una tarea, no únicamente la tarifa publicada por millón de tokens.

DeepSeek V4-Flash es un modelo de IA que procesa y genera tokens para resolver tareas del Intelligence Index. Los $0.03 corresponden a un promedio ponderado, no a una tarifa fija por cada conversación.

Andrew Ng lanza Context Hub para reparar agentes de código
Te podría interesar:
Andrew Ng lanza Context Hub para reparar agentes de código
Un buceador con equipo de buceo explora las aguas del océano, mostrando una aventura marina.
Foto: Kindel Media / Pexels

El costo por tarea cambia la comparación

DeepSeek V4-Flash cobra $0.14 por millón de tokens de entrada sin caché y $0.28 por millón de tokens de salida. Artificial Analysis convierte esos precios en un costo por tarea para reflejar el volumen de texto que cada modelo procesa y genera.

El costo promedio por tarea reportado para cada modelo fue:

  • DeepSeek V4-Flash: $0.03 por tarea.
  • Kimi K3: $0.86 por tarea.
  • GPT-5.6 Sol: $1.86 por tarea.
  • Claude Fable 5: $3.15 por tarea.

Kimi K3 cuesta casi 29 veces más por tarea que V4-Flash. GPT-5.6 Sol cuesta 62 veces más y Claude Fable 5 llega a 105 veces el costo de DeepSeek.

El precio por token tampoco cuenta toda la historia. Artificial Analysis registró que V4-Flash generó 210 millones de tokens de salida durante su evaluación, más del doble de la mediana de 100 millones entre modelos comparables. El gasto depende también de cuánto razona y cuánto texto genera cada modelo.

Un modelo barato, pero no el líder del índice

El Intelligence Index de Artificial Analysis es un índice que reúne nueve evaluaciones de programación, razonamiento, uso de herramientas y tareas similares al trabajo de oficina.

V4-Flash obtuvo 50 puntos sobre 100. Empató con Gemini 3.6 Flash y quedó 1 punto por debajo de Muse Spark 1.1 de Meta y GLM-5.2 de Z.AI.

Kimi K3 alcanzó 57 puntos. Claude Opus 5, Claude Fable 5 y GPT-5.6 superaron a V4-Flash por al menos 9 puntos.

V4-Flash no lideró la tabla de rendimiento. Su ventaja aparece en la relación entre el costo de ejecutar una tarea y la puntuación que obtiene al completarla.

Caché, licencia y despliegues propios

La documentación oficial de DeepSeek fija un precio de $0.0028 por millón de tokens de entrada en caché, frente a $0.14 cuando la entrada no está almacenada. Esto puede favorecer aplicaciones que reutilizan instrucciones largas, historiales o documentos durante varias llamadas consecutivas.

DeepSeek también advierte que prepara un esquema de precios para horas pico y horas de menor demanda. Durante los periodos de mayor actividad, la tarifa podría duplicarse, aunque la empresa todavía no ha anunciado la fecha de entrada en vigor.

El dato apareció pocos días después del lanzamiento oficial de DeepSeek-V4-Flash-0731, la versión que sustituyó a la vista previa del modelo el 31 de julio de 2026. DeepSeek ofrece sus pesos bajo licencia MIT y mantiene una ventana de contexto de un millón de tokens.

El modelo puede utilizarse mediante la API oficial o descargarse para despliegues propios gracias a sus pesos abiertos. La segunda vía elimina el pago por token, pero traslada el gasto a los servidores, las tarjetas aceleradoras, la electricidad y la operación del sistema.

Para desarrolladores y empresas que necesitan ejecutar muchas tareas, $0.03 por tarea hace atractiva la relación entre costo y rendimiento de V4-Flash, aunque el modelo no supere a sus rivales en el índice. La variable pendiente es el esquema de horas pico: DeepSeek todavía no ha anunciado cuándo entrará en vigor y la tarifa podría duplicarse durante los periodos de mayor demanda.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed

Qwen3.8-Max supera a Kimi K3 en texto

Qwen3.8-Max supera a Kimi K3 en texto

3 de agosto del 2026 a las 11:09 am PDT