⚡ Avaliação rápida

O Token Plan do Qwen 3.8 Max da Alibaba aguenta o tranco? Passei a madrugada rodando uma bateria de testes, e já vou direto ao veredito.

Veredito em uma frase
Aguenta, mas só de noite. Usar o cartão mensal de 39 yuans integralmente no período noturno rende cerca de 1,5 bilhão de tokens por mês; só de dia, cerca de 300 milhões; se a Alibaba cancelar o desconto e voltar ao preço cheio, sobram apenas 30 milhões.

Resumindo: com o desconto noturno o custo-benefício é absurdo; de dia é só razoável; no preço cheio, meia-boca.

📌 Contexto: por que testei isso

Primeiro, o contexto. A Kimi saiu de linha e a GLM está praticamente impossível de comprar. Entre os grandes modelos chineses — tirando esses dois — o Qwen 3.8 Max é, na minha leitura, o melhor no momento.

Alguém pode levantar a versão oficial do DeepSeek — o problema é que, no momento em que escrevo, ela ainda nem foi lançada.

Agora que a Kimi K3 e a GLM 5.2 foram open-sourceadas, certamente vão pipocar vários Token Plans de terceiros para GLM 5.2 e Kimi K3. Só que não vêm do fabricante original, então não há garantia de que a performance bata 100% da referência.

Por isso, minha recomendação aqui é o Token Plan oficial da Alibaba por 39 yuans, rodando Qwen 3.8 Max direto da fonte. E tem um detalhe que pesa: o Qwen 3.8 Max entende imagens, coisa que a GLM 5.2 não faz.

💰 Preço e regras do Token Plan

O cartão mensal mais barato sai por 39 yuans, e a cota vem em duas camadas:

  • Cota de 5 horas: 700 credits (renovam a cada 5 horas)
  • Cota de 7 dias: 2.500 credits (renovam a cada 7 dias)

Na teoria, isso dá 10.000 credits por mês.

Captura de tela do preço do Token Plan do Qwen 3.8 Max

Desconto vigente
  • ☀️ Dia: 10% do preço original
  • 🌙 Noite (22:00 - 08:00 do dia seguinte): 2% do preço original

Então qual é a manha certa? Não toque nele de dia. Só comece a bater tecla depois das 22h.

🔬 Dados reais: o quanto o consumo cai à noite

Comecei a testar depois das 22h de ontem. Pluguei o Qwen 3.8 Max no Zcode e rodei uma rodada de tarefas meio cabeludas.

O resultado saiu assim:

  • Total de tokens consumidos: 31,45 milhões
  • Consumo da cota de 7 dias: 8,6%

Captura do consumo noturno de 31,45 milhões de tokens do Qwen 3.8 Max

Captura do consumo de 8,6% da cota de 7 dias do Qwen 3.8 Max

Fazendo a conta
8,6% da cota de 7 dias = 215 credits
215 credits renderam 31,45 milhões de tokens
Com o desconto noturno de 2%, o custo-benefício é de outro nível

O que esse volume significa na prática? Equivale a jogar o contexto completo de um projeto médio dentro do modelo, rodar várias passadas de refactor, testes e otimização — e ainda assim gastar menos de um décimo da cota semanal.

📊 Consumo mensal por cenário

Pelas minhas contas, com o cartão mensal mais barato de 39 yuans:

Comparação dos três cenários
  • 🌙 Uso integral à noite: 360 milhões de tokens a cada 7 dias → cerca de 1,5 bilhão de tokens por mês
  • ☀️ Uso integral de dia: pouco mais de 70 milhões de tokens a cada 7 dias → cerca de 300 milhões de tokens por mês
  • 💸 Preço cheio (sem desconto): pouco mais de 7 milhões de tokens a cada 7 dias → cerca de 30 milhões de tokens por mês

Qual o tamanho do fosso? O uso noturno rende 5 vezes mais que o diurno e 50 vezes mais que o preço cheio.

Portanto, se sua rotina for flexível, vale muito concentrar as tarefas pesadas entre 22h e 8h da manhã — pelo mesmo dinheiro, 5 vezes mais volume.

📝 Veredito: vale a pena comprar?

No conjunto da obra, vale muito — mas com ressalvas.

  1. Se você já tem assinatura do GPT ou do Claude, ou usa um gateway/proxy, nem precisa ler este artigo
  2. Se você usa grandes modelos chineses, não consegue comprar Kimi nem GLM e não quer ir de Token Plan de terceiro, o Qwen 3.8 Max entra na consideração
  3. Recomendo começar pelo Qoder, que é grátis; se curtir a experiência, aí sim compre o Token Plan e plugue em softwares de agent como o opencode

39 yuans não é muito, mas também não é o tipo de coisa "é barato, compro que não perco nada". Teste a cota grátis antes de pagar — sem impulso.

Se você se acostuma com o ritmo de trabalhar de madrugada, o custo-benefício desse Token Plan é praticamente imbatível entre os grandes modelos chineses de hoje.

❓ Perguntas frequentes

Quanto custa por mês o Token Plan do Qwen 3.8 Max?

O cartão mensal mais barato sai por 39 yuans, com cota de 5 horas (700 credits) e cota de 7 dias (2.500 credits). Na teoria, são 10.000 credits por mês.

Quantos tokens rendem o Qwen 3.8 Max por mês?

Depende do horário de uso. Usando só à noite, cerca de 1,5 bilhão de tokens; só de dia, cerca de 300 milhões; no preço cheio (sem desconto), apenas uns 30 milhões. O uso noturno rende 5 vezes mais que o diurno.

Como funciona o desconto noturno da Alibaba?

A Alibaba está com um desconto por tempo limitado: de dia, você paga 10% do preço original; das 22h às 08h do dia seguinte, paga 2% do preço original. Usar de madrugada é a chave do custo-benefício.

Como escolher entre Qwen 3.8 Max, Kimi e GLM?

A Kimi já saiu de linha e a GLM é praticamente impossível de comprar. Se essas duas voltarem a vender, priorize. Por enquanto, o Token Plan oficial do Qwen 3.8 Max é o mais vale a pena entre os grandes modelos chineses. E o Qwen entende imagens, diferentemente da GLM 5.2.

Vale a pena comprar o Token Plan do Qwen 3.8 Max?

Se você usa grandes modelos chineses, gosta de trabalhar de madrugada e precisa plugar em softwares de agent (como o opencode), o cartão de 39 yuans tem custo-benefício altíssimo. Mas, se já tem assinatura do GPT ou do Claude, dispensa. Recomendo começar pela cota grátis do Qoder.

O Qwen 3.8 Max entende imagens?

Sim. O Qwen 3.8 Max suporta compreensão de imagens — uma vantagem importante dele sobre a GLM 5.2.

Qual é a cota grátis do Qoder?

O Qoder oferece uma cota grátis do Qwen 3.8 Max, cujo tamanho pode variar ao longo do tempo. Vale usar de graça no Qoder primeiro e, se gostar, comprar o Token Plan para plugar em outras ferramentas.

Em quais softwares dá para plugar o Token Plan do Qwen 3.8 Max?

Dá para plugar em softwares de agent como Zcode e opencode — perfeito para tarefas complexas como refactor em várias passadas, testes automatizados etc. No meu teste, uma rodada de tarefa de nível de projeto médio consumiu só 8,6% da cota semanal.


Este artigo foi compilado a partir de uma coluna no Zhihu. As opiniões são apenas de referência e não constituem recomendação de investimento.