⚡ O que aconteceu
No final de junho de 2026, a DeepSeek soltou uma bomba: preço por faixa horária em API de IA. É algo inédito — nenhuma grande fabricante de IA (OpenAI, Anthropic, Google, Meta) jamais fez isso. Concessionária de energia pratica tarifa branca, app de transporte cobra preço de pico, mas API de IA? A DeepSeek foi a primeira, e isso muda completamente a economia de usar LLMs em larga escala.
Em termos simples: no horário comercial da China (pico), o preço dobra. À noite e nos fins de semana (fora de pico), o preço atual baixo se mantém. A precificação entra em vigor após o lançamento oficial do V4 (meados de julho de 2026), com aviso por e-mail 24 horas antes da mudança.
📊 Os números: preço de pico vs. fora de pico
Os horários de pico são dias úteis, das 9:00–12:00 e das 14:00–18:00 (horário de Pequim, UTC+8). Todos os demais horários — incluindo fins de semana, intervalo de almoço e madrugada — são fora de pico, com metade do preço.
| Item cobrado | V4 Pro (fora de pico) | V4 Pro (pico) | V4 Flash (fora de pico) | V4 Flash (pico) |
|---|---|---|---|---|
| Cache hit | ¥0.025 / milhão de tokens | ¥0.05 / milhão de tokens | ¥0.02 / milhão de tokens | ¥0.04 / milhão de tokens |
| Cache miss | ¥3 / milhão de tokens | ¥6 / milhão de tokens | ¥1 / milhão de tokens | ¥2 / milhão de tokens |
| Saída | ¥6 / milhão de tokens | ¥12 / milhão de tokens | ¥2 / milhão de tokens | ¥4 / milhão de tokens |
🕐 Pico em Pequim = que horas no seu fuso?
| Pico em Pequim (seg–sex) | Oeste dos EUA, PDT | Leste dos EUA, EDT | Londres, BST | Tóquio, JST |
|---|---|---|---|---|
| 9:00 – 12:00 | dia anterior, 18:00 – 21:00 | dia anterior, 21:00 – 00:00 | 02:00 – 05:00 | 10:00 – 13:00 |
| 14:00 – 18:00 | 23:00 – 03:00 | 02:00 – 06:00 | 07:00 – 11:00 | 15:00 – 19:00 |
Os horários de pico em Pequim (em vermelho na tabela acima) correspondem, para quem está nos EUA, ao final da tarde e à noite. Ou seja: quando o americano trabalha durante o dia, a China está dormindo — e a DeepSeek está em preço fora de pico. O inverso também vale: quando a China trabalha, os EUA dormem. Isso cria um ciclo perfeito de arbitragem bidirecional.
🌍 Manual de arbitragem bidirecional
Como os horários de pico e fora de pico da DeepSeek são definidos em horário de Pequim, o mesmo relógio significa realidades opostas para pessoas em lugares diferentes. Veja abaixo os dois sentidos e, em cada um, o passo a passo prático.
Configuração:
1. Registre uma conta DeepSeek com número de celular chinês (garante o preço-base mais baixo)
2. Seu horário fora de pico (noite de Pequim, das 18:00 às 09:00, mais o fim de semana inteiro) = dia nas Américas e na Europa — exatamente quando os desenvolvedores ocidentais estão mais ativos
3. Rode um proxy de API simples que recebe as requisições dos usuários ocidentais e as encaminha para a DeepSeek fora do pico
A conta:
• Saída do V4 Flash fora de pico: ¥2/milhão de tokens (≈ $0.27/milhão)
• Saída do OpenAI GPT-4o: $10/milhão de tokens
• Diferença: 37x. Você pode revender a $2–5/milhão de tokens, ainda 2–5x mais barato que a OpenAI, com lucro líquido de 7–18x.
Ideal para: processamento em lote, geração de conteúdo, revisão de código, tradução — qualquer tarefa que tolere alguns minutos de latência. O usuário ocidental envia o trabalho durante o dia útil, seu proxy enfileira e processa à noite no horário de Pequim, pelo preço fora de pico.
Configuração:
1. Se a DeepSeek oferecer horários de pico por região de registro (por exemplo, contas registradas nos EUA seguindo o horário comercial americano), registre com número americano ou europeu
2. Seu fora de pico (noite nos EUA) = dia em Pequim — exatamente quando o desenvolvedor chinês está trabalhando
3. No seu horário fora de pico, faça o proxy das requisições dos usuários chineses pela conta americana
⚠️ Aviso importante: Até julho de 2026, a DeepSeek só anunciou precificação por faixa horária (baseada em horário de Pequim) para contas da região chinesa. Ainda não está claro se contas internacionais terão seus próprios horários de pico regionais ou se seguirão todas o horário de Pequim. Vamos acompanhar e atualizar este texto quando a versão oficial sair. Se as contas internacionais também seguirem o horário de Pequim, o Sentido 2 deixa de valer — mas o Sentido 1 continua válido e, aliás, já é a jogada mais forte.
Ideal para: caso os horários de pico regionais sejam confirmados, atender desenvolvedores chineses que estouraram a cota da DeepSeek no pico e precisam de capacidade de overflow. Sua conta americana entrega preço fora de pico justamente na hora em que eles mais precisam.
🔧 Como montar o proxy (parte técnica)
Não precisa de nada sofisticado. Rodar um proxy de fila simples numa VPS barata (ou até numa Raspberry Pi em casa) já dá conta. A arquitetura é bem simples:
1. Camada de entrada — um endpoint compatível com o formato OpenAI que recebe as requisições dos clientes ocidentais 24/7
2. Fila — os jobs entram numa fila Redis (SQLite também resolve em pequena escala). Cada job recebe prioridade e prazo.
3. Scheduler — um processo estilo cron que verifica: "agora é fora de pico em Pequim?" Se sim, esvazia a fila encaminhando para a API da DeepSeek. Se não, espera.
4. Camada de resposta — o resultado volta, é armazenado e entregue ao cliente (polling ou callback via webhook)
Otimização-chave: use agressivamente o cache de contexto da DeepSeek. Token com cache hit custa só ¥0.02–0.025/milhão (fora de pico) — praticamente de graça. Estruture seus prompts para maximizar o reuso do cache (system prompt, documentos longos, codebase).
⏰ Lógica do scheduler (pseudocódigo)
# Verifica se o momento atual é horário fora de pico em Pequim
import datetime
def is_beijing_offpeak():
now = datetime.datetime.now(datetime.timezone(datetime.timedelta(hours=8)))
weekday = now.weekday() # 0=Seg, 6=Dom
hour = now.hour
# Finais de semana: fora de pico o dia todo
if weekday >= 5:
return True
# Dias úteis: 9-12 e 14-18 são pico, o resto é fora de pico
if 9 <= hour < 12:
return False
if 14 <= hour < 18:
return False
return True
# Loop principal: só processa a fila fora de pico
while True:
if is_beijing_offpeak():
job = queue.pop()
if job:
result = deepseek_api.chat(job.prompt, model="deepseek-v4-flash")
store_result(job.id, result)
else:
time.sleep(60) # No pico, dorme e espera o fora de pico
💰 A mina de ouro dos fins de semana
Este é o ponto que a maioria ignora: as 48 horas inteiras do fim de semana são fora de pico. Dois dias por semana, em qualquer fuso, é metade do preço. Se você agendar seus trabalhos pesados para rodar entre a sexta à noite e o domingo, basicamente nunca vai pagar preço de pico. Para qualquer SaaS que processa muito texto — resumos, traduções, moderação de conteúdo, extração de dados — só isso já corta de 30 a 40% da conta de API, sem nenhuma malandragem de fuso horário.
1. Durante a semana, colete todas as tarefas não urgentes
2. Sexta às 18:00 no horário de Pequim: dispare o worker de lote
3. Processe por 48 horas seguidas, tudo em preço fora de pico
4. Segunda de manhã: tudo entregue, e a conta sai a 50% do normal
Para quem processa milhões de tokens por dia, isso não é troco de bala — é a diferença entre operar no lucro ou no prejuízo.
📋 Caso real: bot de calendário da Copa do Mundo
Um desenvolvedor chinês (Qingxiawa) usou a DeepSeek V4 para construir um bot que raspava automaticamente a tabela de jogos da Copa do Mundo e gerava eventos de calendário. Antes de a precificação por faixa horária entrar em vigor, ele gastou ¥60 (cerca de $8.20) para rodar um mês inteiro. Extração de dados estruturados a partir de páginas web, todo dia, por 30 dias seguidos.
Mesmo no preço de pico (saída do V4 Pro a ¥12/milhão de tokens), o mesmo bot custaria ~¥120/mês — ainda menos de $17. Fora de pico, cai para ¥60/mês. E isso é no V4 Pro. Se você trocar para o V4 Flash nesse tipo de trabalho em lote, a saída sai por ¥2–4/milhão de tokens. Aquele bot que custou ¥60 no V4 Pro, no V4 Flash fora de pico custaria apenas ¥10–20. Ou seja, $1.40–2.80 para rodar um mês inteiro de automação de extração de dados. A OpenAI cobraria $100–200+ pelo GPT-4o na mesma carga.
⚠️ Riscos e cuidados
1. Termos de serviço
Revender acesso à API pode violar os termos de serviço da DeepSeek. Antes de montar um negócio em cima disso, leia a letra miúda com atenção. No mínimo, não chame de "revenda de DeepSeek" — posicione como um serviço de valor agregado que, por baixo dos panos, usa DeepSeek. Coloque por cima a sua própria UI, gestão de fila, camada de cache ou otimização de prompt, de modo que você venda um produto, não acesso cru à API.
2. Latência
O proxy com fila adiciona latência. Se um usuário ocidental envia o trabalho às 9h no horário do Pacífico (meia-noite em Pequim — fora de pico), é processado na hora. Mas se ele envia às 18h no Pacífico (9h em Pequim — pico), vai esperar 3 horas (até o almoço em Pequim) ou 9 horas (até as 18h em Pequim, quando entra no fora de pico). Deixe isso muitíssimo claro para o cliente. Chat em tempo real não é o caso de uso aqui — lote, tarefas assíncronas e cargas noturnas, sim.
3. O preço pode mudar
A DeepSeek se compromete a avisar por e-mail com 24 horas de antecedência antes de qualquer mudança de preço. É leal, mas significa que sua margem pode mudar da noite para o dia. Ao construir o negócio, deixe folga suficiente para que um aumento de 2x não seja fatal. Além disso: o multiplicador entre pico e fora de pico pode ser ajustado ao longo do tempo. Começa em 2x, mas pode virar 3x ou 1.5x dependendo de como a DeepSeek calibra. Não construa um modelo de negócio que só se sustenta com exatamente 2x.
4. Barreira da conta
Hoje, registrar a conta DeepSeek com o preço mais baixo exige número de celular chinês. Se você está no exterior, vai precisar de um contato na China ou de um serviço de número virtual. Esse é o maior atrito para o desenvolvedor ocidental que quer executar o Sentido 1. No outro sentido, se você está na China ou tem parceiros chineses, tem uma assimetria de informação que a maioria dos desenvolvedores ocidentais não tem — aproveite.
⏳ Conclusão
A precificação por faixa horária da DeepSeek não é só um experimento esquisito de cobrança — é uma mudança estrutural que cria uma oportunidade real de arbitragem. A economia é simples: quando o seu custo de computação cai 50% durante meio dia, e esse meio dia se alinha com o ritmo do seu cliente, você encontrou um spread que vale a pena explorar.
Faça três coisas agora:
- Registre sua conta DeepSeek antes do lançamento oficial do V4 — garanta o acesso enquanto ainda é fácil. Depois de julho, conforme a conscientização se espalha, a política de registro pode apertar.
- Monte um pipeline de lote para os fins de semana — mesmo sem nenhuma arbitragem ou revenda, simplesmente mover suas cargas pesadas para o fim de semana já economiza 50% na hora.
- Acompanhe a política de horários de pico regionais — se a DeepSeek lançar horários de pico por região de registro, o Sentido 2 se abre e a arbitragem vira totalmente bidirecional.
A janela dessa oportunidade é limitada. As demais fabricantes de IA estão de olho no experimento da DeepSeek. Se a precificação por faixa horária se mostrar bem-sucedida (o que é provável — é só a economia de oferta e demanda aplicada a um cluster de GPUs), OpenAI e Anthropic muito provavelmente seguirão o mesmo caminho em 12–18 meses. Nesse ponto, o espaço de arbitragem vai se estreitar, porque todos estarão jogando o mesmo jogo. Os pioneiros — os que montarem a infra de proxy agora, enquanto ainda é novidade — vão abocanhar a parte mais gorda do lucro.
O fuso horário é a sua vantagem. Aproveite antes que todo mundo entenda o jogo.