TL;DR: DeepSeek acaba de anunciar que los precios de la API V4 se duplicarán en horario laboral (de 9:00 a 12:00 y de 14:00 a 18:00, hora de Pekín). El lanzamiento oficial de V4 está previsto para mediados de julio de 2026. Incluso con la tarifa de hora punta, DeepSeek sigue siendo, con bastante margen, la API de IA frontera más barata del mundo.

⚡ Qué ha pasado

El 29 de junio, DeepSeek envió a sus usuarios un correo con el asunto «Plan de lanzamiento oficial y ajuste de facturación de DeepSeek V4». El cambio principal: tarifación dinámica por franja horaria, una primicia entre los grandes proveedores de APIs de IA.

Durante las horas punta (de 9:00 a 12:00 y de 14:00 a 18:00, hora de Pekín, en días laborables), todos los precios de la API V4 se duplican. El resto del tiempo los precios se mantienen en sus niveles actuales, que ya son ridículamente bajos.

Piensalo como el surge pricing de Uber, pero aplicado a tokens de IA. Cuando todo el mundo programa a la vez, pagas un sobrecargo. ¿Lanzas tus jobs por lotes a las 3 de la mañana? Te llevas el descuento.

📊 Las tablas de precios

DeepSeek V4 Pro

Concepto de facturaciónHora valle (¥/M tokens)Hora punta (¥/M tokens)
Entrada (cache hit)¥0,025¥0,05
Entrada (cache miss)¥3,00¥6,00
Salida¥6,00¥12,00

DeepSeek V4 Flash

Concepto de facturaciónHora valle (¥/M tokens)Hora punta (¥/M tokens)
Entrada (cache hit)¥0,02¥0,04
Entrada (cache miss)¥1,00¥2,00
Salida¥2,00¥4,00
⚡ A tener en cuenta: incluso en hora punta, la salida de DeepSeek V4 Flash cuesta ¥4/M tokens, es decir, unos $0,56 por millón de tokens. Compáralo con los $30/M de GPT-5.5 o los $25/M de Claude Opus 4.8. En su versión más cara, DeepSeek sigue siendo de 45 a 50 veces más barata que el modelo frontera de OpenAI.

📋 Costes reales

¿Los precios solos no te dicen nada? Vamos a la factura real. Un desarrollador de Appinn compartió sus cifras de uso real: lleva un mes entero usando DeepSeek V4 Flash para actualizar automáticamente un calendario del Mundial — scrapeando resultados, goles y datos de los partidos:

  • Día normal: unos ¥2 (aprox. $0,28)
  • Día cargado (arreglar bugs, reejecutar tareas): ¥13 (aprox. $1,82)
  • Total del mes: ¥60 (aprox. $8,40)

Así es: una pipeline automatizada corriendo a diario durante un mes entero ha costado menos que un almuerzo en San Francisco.

🏆 Frente a la competencia

Estos son los precios de salida de los principales modelos, en dólares por millón de tokens:

ModeloSalida $/MVentana de contexto
DeepSeek V4 Flash (hora valle / punta)$0,28 / $0,561.000.000
DeepSeek V4 Pro (hora valle / punta)$0,87 / $1,741.000.000
Xiaomi MiMo V2.5$0,281.000.000
Xiaomi MiMo V2.5 Pro$0,871.000.000
MiniMax M3$1,201.000.000
GLM-5.1 (Zhipu)$4,40200.000
Kimi K2.6¥27 ≈ $3,78262.000
Qwen3.7 Plus¥8 ≈ $1,121.000.000
GPT-5.5 (OpenAI)$30,001.100.000
Claude Opus 4.8 (Anthropic)$25,001.000.000

En la franja de «ridículamente barato con 1M de contexto», el rival más cercano es Xiaomi MiMo V2.5, que empata con DeepSeek V4 Flash en $0,28/M de salida, pero sin recargo en hora punta. Si eres sensible al coste y no quieres andar mirando el reloj, MiMo puede ser la opción más segura.

🤔 Por qué lo hace

La razón es sencilla: gestión de capacidad. Los servidores de DeepSeek se saturan durante el horario laboral chino. En vez de rechazar usuarios (o dejar que la calidad se degradé por sobrecarga), usan la señal de precio para aplanar la demanda.

En realidad, es economía de infraestructura bastante inteligente. AWS, Google Cloud y todos los grandes proveedores cloud llevan años haciéndolo con spot instances y capacidad reservada. DeepSeek simplemente es el primer proveedor de APIs de IA que aplica esa misma lógica a la inferencia de modelos de lenguaje.

Cabe esperar imitadores. Si DeepSeek demuestra que este modelo funciona, Kimi y Qwen casi con seguridad sacarán sus propias tarifas valle/punta.

🎯 Qué deberías hacer

  1. Si el coste te importa: programa las cargas pesadas (procesamiento por lotes, generación de datos de entrenamiento, análisis a gran escala) fuera del horario laboral de Pekín (9:00–12:00 y 14:00–18:00). Tu cartera lo agradecerá.
  2. Si necesitas disponibilidad 24/7: presupuesta con precios de hora punta, o móntate una cadena de fallback que enrute el tráfico de las horas punta hacia MiMo V2.5 o Qwen3.7 Plus, y devuélvelo a DeepSeek en las horas valle.
  3. Si estás en plan gratuito o con poco presupuesto: V4 Flash en tarifa valle es prácticamente gratis. Entrada a ¥1/M (cache miss) significa que puedes procesar 1 millón de tokens de entrada más 1 millón de tokens de salida por unos ¥3 (41 centavos). Toda una novela de principio a fin: leída, analizada y devuelta.
🔮 Pronóstico: el surge pricing de DeepSeek V4 es el primer síntoma. Antes de que acabe el cuarto trimestre de 2026, al menos otros dos proveedores chinos de IA habrán adoptado tarifas por franja horaria. La era de la «IA ilimitada a precio único» se está acabando — y, sinceramente, es bueno para el ecosistema. Significa que la IA se está convirtiendo en infraestructura de verdad, y no en una demo barata para captar usuarios a pérdida.

⏳ Conclusión

Aun al doble de precio, DeepSeek V4 sigue siendo la API de IA frontera más barata del mundo. La tarifación por franja horaria es una feature, no un bug: indica que DeepSeek tiene tanta demanda que necesita gestionar la capacidad, y lo deja claro de forma transparente en el precio.

Si estás construyendo sobre APIs de IA chinas (y deberías: la diferencia de precio frente a los proveedores estadounidenses ya es absurda), DeepSeek V4 Flash sigue siendo la opción por defecto para todo lo que no requiera entrada multimodal. Simplemente ejecuta los trabajos pesados después de cenar.


Fuentes: correo a usuarios de DeepSeek (29 de junio de 2026), reportaje de Appinn, directorio de precios de DevTk.AI. Precios revisados el 3 de julio de 2026.