⚡ Qué ha pasado

A finales de junio de 2026, DeepSeek soltó una bomba: tarifación por franjas horarias para APIs de IA. Es algo sin precedentes — ningún proveedor de IA grande (OpenAI, Anthropic, Google, Meta) lo había hecho nunca. Las eléctricas lo hacen. Uber y Cabify lo hacen. ¿Pero las APIs de IA? DeepSeek es el primero, y cambia por completo la economía de usar grandes modelos de lenguaje a escala.

La versión corta: durante el horario laboral de China (punta), los precios se duplican. Por la noche y los fines de semana (valle), se mantienen en las tarifas bajas actuales. Los precios entrarán en vigor con el lanzamiento oficial de V4 a mediados de julio de 2026, y los usuarios recibirán un aviso por email 24 horas antes del cambio.

📊 Los números: punta vs valle

Las horas punta son días laborables de 9:00–12:00 y de 14:00–18:00, hora de Pekín (UTC+8). Todo lo demás — incluidos fines de semana, pausa de comida y madrugada — es tarifa de valle, a mitad de precio.

ConceptoV4 Pro (valle)V4 Pro (punta)V4 Flash (valle)V4 Flash (punta)
Acierto de caché¥0,025 / M tokens¥0,05 / M tokens¥0,02 / M tokens¥0,04 / M tokens
Fallo de caché¥3 / M tokens¥6 / M tokens¥1 / M tokens¥2 / M tokens
Salida¥6 / M tokens¥12 / M tokens¥2 / M tokens¥4 / M tokens

🕐 ¿A qué hora corresponde la franja punta de Pekín en tu zona horaria?

Punta Pekín (lun–vie)Costa oeste EE. UU. (PDT)Costa este EE. UU. (EDT)Londres (BST)Tokio (JST)
9:00 – 12:0018:00 – 21:00 (día anterior)21:00 – 00:00 (día anterior)02:00 – 05:0010:00 – 13:00
14:00 – 18:0023:00 – 03:0002:00 – 06:0007:00 – 11:0015:00 – 19:00
💡 La clave
Las horas punta de Pekín (en rojo arriba) son tarde y noche en Estados Unidos. Eso significa que cuando los estadounidenses trabajan de día, en China es de noche — y DeepSeek está en tarifa de valle. Y al revés también: cuando China trabaja, EE. UU. duerme. Esto crea un bucle de arbitraje bidireccional perfecto.

🌍 El manual de arbitraje bidireccional

Como la franja punta/valle de DeepSeek está atada a la hora de Pekín, el mismo reloj crea realidades opuestas dependiendo de dónde estés tú y tus clientes. Aquí van las dos direcciones, y cómo ejecutar cada una al detalle.

🅰️ Dirección 1: cuenta china → vender a usuarios occidentales

Configuración:
1. Registra una cuenta en DeepSeek con un número de teléfono chino (consigue la tarifa base más baja)
2. Tus horas valle (noche de Pekín: 18:00–09:00, más todo el fin de semana) coinciden con el día en EE. UU./UE — justo cuando los desarrolladores occidentales están más activos
3. Monta un proxy de API sencillo que reciba peticiones de usuarios occidentales y las reenvíe a DeepSeek en horas valle

Los números:
• Salida V4 Flash en valle: ¥2/M tokens (≈ $0,27/M)
• Salida OpenAI GPT-4o: $10/M tokens
• Diferencia de precio: 37 veces más barato. Puedes revender a $2–5/M y seguir siendo 2–5 veces más barato que OpenAI mientras te quedas un margen de 7–18x.

Ideal para: procesamiento por lotes, generación de contenido, revisión de código, traducción — cualquier cosa que tolere unos minutos de retardo. Los usuarios occidentales mandan tareas durante su jornada, tu proxy las encola y se procesan de noche (hora de Pekín) a tarifa de valle.
🅱️ Dirección 2: cuenta occidental → vender a usuarios chinos

Configuración:
1. Si DeepSeek ofrece horas punta por región (p. ej., una cuenta registrada en EE. UU. sigue el horario laboral estadounidense), regístrate con un número de EE. UU./UE
2. Tu valle (noche en EE. UU.) = día en Pekín — justo cuando los desarrolladores chinos están trabajando
3. Encamina las peticiones de usuarios chinos a través de tu cuenta estadounidense durante tus horas valle

⚠️ Aviso importante: A julio de 2026, DeepSeek solo ha anunciado tarifa punta/valle basada en hora de Pekín para cuentas de la región de China. No está claro si las cuentas internacionales tendrán su propia franja punta regional o si simplemente seguirán la hora de Pekín. Lo seguimos de cerca y actualizaremos este artículo en cuanto el lanzamiento oficial aclare la política. Si las cuentas internacionales también siguen la hora de Pekín, la Dirección 2 no funciona — pero la Dirección 1 sí, y de todas formas es la jugada más fuerte.

Ideal para: si se confirman horas punta regionales: dar servicio a desarrolladores chinos que se quedan sin cuota de DeepSeek en horas punta y necesitan capacidad de desborde. Tu cuenta estadounidense les da precio de valle durante su hora de mayor actividad.

🔧 Cómo montar el proxy (inmersión técnica)

No necesitas nada sofisticado. Un proxy basado en colas sobre un VPS barato (o incluso una Raspberry Pi en casa) basta. La arquitectura es directa:

🔄 Arquitectura del proxy (Dirección 1)

1. Capa de ingesta — un endpoint compatible con el formato OpenAI que reciba peticiones de tus clientes occidentales 24/7
2. Cola — los trabajos entran en una cola de Redis (o incluso SQLite para bajo volumen). Etiqueta cada trabajo con prioridad y deadline.
3. Scheduler — un proceso tipo cron que comprueba: «¿Estamos en valle en Pekín ahora mismo?» Si sí, vacía la cola y reenvía a la API de DeepSeek. Si no, espera.
4. Capa de respuesta — los resultados vuelven, se almacenan y se sirven a los clientes (por polling o por callback de webhook)

Optimización clave: usa el context caching de DeepSeek a tope. Los tokens con acierto de caché cuestan ¥0,02–0,025/M (valle) — casi gratis. Estructura tus prompts para maximizar la reutilización de caché (system prompts, documentos largos, codebases).

⏰ Lógica del scheduler (pseudocódigo)

# Comprobar si ahora mismo es franja valle en Pekín
import datetime

def is_beijing_offpeak():
    now = datetime.datetime.now(datetime.timezone(datetime.timedelta(hours=8)))
    weekday = now.weekday()  # 0=lun, 6=dom
    hour = now.hour

    # Fin de semana: todo el día es valle
    if weekday >= 5:
        return True

    # Días laborables: 9-12 y 14-18 son punta, el resto valle
    if 9 <= hour < 12:
        return False
    if 14 <= hour < 18:
        return False
    return True

# Bucle principal: solo procesa la cola en valle
while True:
    if is_beijing_offpeak():
        job = queue.pop()
        if job:
            result = deepseek_api.chat(job.prompt, model="deepseek-v4-flash")
            store_result(job.id, result)
    else:
        time.sleep(60)  # En punta, duerme y espera al valle

💰 La mina de oro del fin de semana

Aquí está la parte que la mayoría se pasa por alto: las 48 horas enteras del fin de semana son valle. Son dos días completos a la semana con tokens a mitad de precio, da igual la zona horaria. Si programas tus cargas pesadas en lote para que corran del viernes por la noche al domingo, prácticamente nunca pagas tarifa de punta. Para un SaaS que procesa grandes volúmenes de texto — resúmenes, traducción, moderación de contenido, extracción de datos — solo con esto puedes recortar la factura de API un 30–40%, sin ningún truco de zonas horarias.

🧠 Estrategia avanzada: el pipeline de lotes de fin de semana

1. Recoge durante la semana (lun–vie) todos los trabajos no urgentes
2. Viernes 18:00 hora de Pekín: arranca los workers de batch
3. Procesa sin parar durante 48 horas a tarifa de valle
4. Lunes por la mañana: todos los resultados entregados, factura al 50% de lo que habría sido

Para empresas que procesan millones de tokens al día, esto no son calderilla — es la diferencia entre ser rentable y perder dinero a manos llenas.

📋 Caso real: el bot de calendario del Mundial

Un desarrollador chino (Qingxiaowa) construyó un bot que scrapea los calendarios de partidos del Mundial y genera eventos de calendario usando DeepSeek V4. Ejecutarlo durante un mes entero en la era previa a la tarifa por franjas costó en total ¥60 (unos $8,20). Eso es generar datos estructurados a partir de páginas web a diario, durante 30 días seguidos.

Incluso a tarifa de punta (¥12/M tokens de salida para V4 Pro), ese mismo bot costaría ~¥120/mes — todavía por debajo de $17. En valle, son ¥60/mes. Y eso es con V4 Pro. Si pasas a V4 Flash para este tipo de trabajo por lotes, hablas de ¥2–4/M tokens de salida. El bot que costaba ¥60 en V4 Pro saldría por ¥10–20 en V4 Flash en valle. Eso son $1,40–2,80 por un mes entero de procesamiento de datos automatizado. El GPT-4o de OpenAI cobraría $100–200+ por la misma carga.

⚠️ Riesgos y trampas

1. Condiciones del servicio

Revender acceso a la API puede violar las condiciones de servicio de DeepSeek. Léete la letra pequeña antes de montar un negocio sobre esto. Como mínimo, no lo llames «revender DeepSeek» — posiciónalo como un servicio de valor añadido que resulta usar DeepSeek por debajo. Añade tu propia UI, gestión de colas, una capa de caché o algo de optimización de prompts por encima, de forma que estés vendiendo un producto, no acceso crudo a una API.

2. Latencia

Un proxy con cola introduce retardo. Si un usuario occidental manda un trabajo a las 9 AM hora del Pacífico (medianoche en Pekín — valle), se procesa al momento. Pero si lo manda a las 6 PM hora del Pacífico (9 AM en Pekín — punta), esperará hasta 3 horas (hasta la pausa de comida de Pekín) o 9 horas (hasta las 6 PM, valle vespertino en Pekín). Deja esto cristalino a tus clientes. El chat en tiempo real NO es el caso de uso aquí — procesamiento por lotes, trabajos asíncronos y cargas nocturnas, sí.

3. Los precios pueden cambiar

DeepSeek se ha comprometido a avisar por email con 24 horas de antelación antes de cualquier cambio de precio. Es justo, pero significa que tus márgenes pueden variar de la noche a la mañana. Construye el negocio con suficiente colchón para que una subida del 2x no te hunda. Además: el ratio punta/valle puede cambiar con el tiempo. Lo que empieza como 2x podría convertirse en 3x o 1,5x según DeepSeek afine el sistema. No montes un modelo de negocio que solo funcione con exactamente 2x.

4. Requisitos de la cuenta

A día de hoy, registrar una cuenta de API en DeepSeek en la tarifa más baja requiere un número de teléfono chino. Si estás fuera de China, necesitarás un contacto chino o un servicio de números virtuales. Este es el mayor punto de fricción para los desarrolladores occidentales que quieren ejecutar la Dirección 1. Del otro lado, si ESTÁS en China o tienes socios chinos, disfrutas de una asimetría de información de la que carecen la mayoría de desarrolladores occidentales — aprovéchala.

⏳ Conclusión

La tarifa por franjas de DeepSeek no es un simple experimento curioso de facturación — es un cambio estructural que crea oportunidades reales de arbitraje. La economía es sencilla: cuando tu coste de cómputo es un 50% más bajo durante medio día, y esa mitad coincide con el horario laboral de tus clientes, has encontrado un diferencial que merece la pena explotar.

Tres cosas que hacer ya mismo:

  1. Registra una cuenta de DeepSeek antes del lanzamiento oficial de V4 — asegura el acceso mientras sigue siendo fácil. Después de julio, conforme se extienda el conocimiento, las políticas de registro podrían endurecerse.
  2. Monta un pipeline de lotes para el fin de semana — incluso sin arbitraje ni reventa, mover tus propias cargas pesadas al fin de semana te ahorra un 50% de inmediato.
  3. Vigila la política regional de horas punta — si DeepSeek lanza franjas punta específicas por región, la Dirección 2 se abre y el arbitraje se vuelve totalmente bidireccional.

La ventana para esto es limitada. Otros proveedores de IA están siguiendo de cerca el experimento de DeepSeek. Si la tarifa por franjas demuestra ser un éxito (y probablemente lo será — es economía de oferta y demanda aplicada a clusters de GPUs), espera que OpenAI y Anthropic la sigan en 12–18 meses. Cuando eso pase, los diferenciales de arbitraje se estrechan porque todos juegan al mismo juego. Los primeros en moverse — los que monten su infraestructura de proxy AHORA, mientras sigue siendo novedosa — se quedarán los márgenes más jugosos.

La zona horaria es tu ventaja. Aprovéchala antes de que el resto se dé cuenta.