TL;DR: DeepSeek acaba de anunciar que los precios de la API V4 se duplicarán en horario laboral (de 9:00 a 12:00 y de 14:00 a 18:00, hora de Pekín). El lanzamiento oficial de V4 está previsto para mediados de julio de 2026. Incluso con la tarifa de hora punta, DeepSeek sigue siendo, con bastante margen, la API de IA frontera más barata del mundo.
⚡ Qué ha pasado
El 29 de junio, DeepSeek envió a sus usuarios un correo con el asunto «Plan de lanzamiento oficial y ajuste de facturación de DeepSeek V4». El cambio principal: tarifación dinámica por franja horaria, una primicia entre los grandes proveedores de APIs de IA.
Durante las horas punta (de 9:00 a 12:00 y de 14:00 a 18:00, hora de Pekín, en días laborables), todos los precios de la API V4 se duplican. El resto del tiempo los precios se mantienen en sus niveles actuales, que ya son ridículamente bajos.
Piensalo como el surge pricing de Uber, pero aplicado a tokens de IA. Cuando todo el mundo programa a la vez, pagas un sobrecargo. ¿Lanzas tus jobs por lotes a las 3 de la mañana? Te llevas el descuento.
📊 Las tablas de precios
DeepSeek V4 Pro
| Concepto de facturación | Hora valle (¥/M tokens) | Hora punta (¥/M tokens) |
|---|---|---|
| Entrada (cache hit) | ¥0,025 | ¥0,05 |
| Entrada (cache miss) | ¥3,00 | ¥6,00 |
| Salida | ¥6,00 | ¥12,00 |
DeepSeek V4 Flash
| Concepto de facturación | Hora valle (¥/M tokens) | Hora punta (¥/M tokens) |
|---|---|---|
| Entrada (cache hit) | ¥0,02 | ¥0,04 |
| Entrada (cache miss) | ¥1,00 | ¥2,00 |
| Salida | ¥2,00 | ¥4,00 |
📋 Costes reales
¿Los precios solos no te dicen nada? Vamos a la factura real. Un desarrollador de Appinn compartió sus cifras de uso real: lleva un mes entero usando DeepSeek V4 Flash para actualizar automáticamente un calendario del Mundial — scrapeando resultados, goles y datos de los partidos:
- Día normal: unos ¥2 (aprox. $0,28)
- Día cargado (arreglar bugs, reejecutar tareas): ¥13 (aprox. $1,82)
- Total del mes: ¥60 (aprox. $8,40)
Así es: una pipeline automatizada corriendo a diario durante un mes entero ha costado menos que un almuerzo en San Francisco.
🏆 Frente a la competencia
Estos son los precios de salida de los principales modelos, en dólares por millón de tokens:
| Modelo | Salida $/M | Ventana de contexto |
|---|---|---|
| DeepSeek V4 Flash (hora valle / punta) | $0,28 / $0,56 | 1.000.000 |
| DeepSeek V4 Pro (hora valle / punta) | $0,87 / $1,74 | 1.000.000 |
| Xiaomi MiMo V2.5 | $0,28 | 1.000.000 |
| Xiaomi MiMo V2.5 Pro | $0,87 | 1.000.000 |
| MiniMax M3 | $1,20 | 1.000.000 |
| GLM-5.1 (Zhipu) | $4,40 | 200.000 |
| Kimi K2.6 | ¥27 ≈ $3,78 | 262.000 |
| Qwen3.7 Plus | ¥8 ≈ $1,12 | 1.000.000 |
| GPT-5.5 (OpenAI) | $30,00 | 1.100.000 |
| Claude Opus 4.8 (Anthropic) | $25,00 | 1.000.000 |
En la franja de «ridículamente barato con 1M de contexto», el rival más cercano es Xiaomi MiMo V2.5, que empata con DeepSeek V4 Flash en $0,28/M de salida, pero sin recargo en hora punta. Si eres sensible al coste y no quieres andar mirando el reloj, MiMo puede ser la opción más segura.
🤔 Por qué lo hace
La razón es sencilla: gestión de capacidad. Los servidores de DeepSeek se saturan durante el horario laboral chino. En vez de rechazar usuarios (o dejar que la calidad se degradé por sobrecarga), usan la señal de precio para aplanar la demanda.
En realidad, es economía de infraestructura bastante inteligente. AWS, Google Cloud y todos los grandes proveedores cloud llevan años haciéndolo con spot instances y capacidad reservada. DeepSeek simplemente es el primer proveedor de APIs de IA que aplica esa misma lógica a la inferencia de modelos de lenguaje.
Cabe esperar imitadores. Si DeepSeek demuestra que este modelo funciona, Kimi y Qwen casi con seguridad sacarán sus propias tarifas valle/punta.
🎯 Qué deberías hacer
- Si el coste te importa: programa las cargas pesadas (procesamiento por lotes, generación de datos de entrenamiento, análisis a gran escala) fuera del horario laboral de Pekín (9:00–12:00 y 14:00–18:00). Tu cartera lo agradecerá.
- Si necesitas disponibilidad 24/7: presupuesta con precios de hora punta, o móntate una cadena de fallback que enrute el tráfico de las horas punta hacia MiMo V2.5 o Qwen3.7 Plus, y devuélvelo a DeepSeek en las horas valle.
- Si estás en plan gratuito o con poco presupuesto: V4 Flash en tarifa valle es prácticamente gratis. Entrada a ¥1/M (cache miss) significa que puedes procesar 1 millón de tokens de entrada más 1 millón de tokens de salida por unos ¥3 (41 centavos). Toda una novela de principio a fin: leída, analizada y devuelta.
⏳ Conclusión
Aun al doble de precio, DeepSeek V4 sigue siendo la API de IA frontera más barata del mundo. La tarifación por franja horaria es una feature, no un bug: indica que DeepSeek tiene tanta demanda que necesita gestionar la capacidad, y lo deja claro de forma transparente en el precio.
Si estás construyendo sobre APIs de IA chinas (y deberías: la diferencia de precio frente a los proveedores estadounidenses ya es absurda), DeepSeek V4 Flash sigue siendo la opción por defecto para todo lo que no requiera entrada multimodal. Simplemente ejecuta los trabajos pesados después de cenar.
Fuentes: correo a usuarios de DeepSeek (29 de junio de 2026), reportaje de Appinn, directorio de precios de DevTk.AI. Precios revisados el 3 de julio de 2026.