📝 Blog

Análises profundas sobre preços de IA chinesa, lançamentos de modelos e estratégias para conseguir o melhor acordo.
  • Kimi K3 + claude-context: reduza o consumo de tokens em 27% com recuperação semântica de código

    Um teste real em uma base de código Django mostra que adicionar o claude-context MCP ao Kimi K3 reduz o consumo de tokens em 27,1% e as chamadas de ferramentas em 55%, além de elevar o F1 de localização de código de 0,844 para 0,946.

  • Plano de tokens Qwen 3.8 Max em análise: 1,5 bilhão de tokens por 39 yuans/mês?

    Um teste real do Plano de tokens Qwen 3.8 Max da Alibaba a 39 yuans/mês. O uso noturno rende cerca de 1,5 bilhão de tokens/mês com desconto de 0,2x, o diurno cerca de 300 milhões com desconto de 1x e apenas 30 milhões no preço cheio. Análise de preços da IA da China.

  • Gemini 3.6 Flash: US$ 7,50, 304 tokens/s — por que o Google vencerá a corrida de IA

    O Gemini 3.6 Flash entrega 304 tokens/s por apenas US$ 7,50 no preço de saída, superando o 3.1 Pro em inteligência. Com os dados, as reservas de caixa, a infraestrutura de computação e os talentos inigualáveis do Google, o vencedor final da corrida de IA pode já estar decidido.

  • Por que o debate sobre a proibição do Kimi K3 não faz sentido — e por que só fortalece a IA da China

    O Axios informa que o governo Trump estuda proibir modelos de IA chineses como Kimi K3 e DeepSeek. Três motivos pelos quais isso não vai funcionar: pesos abertos não podem ser retirados de circulação, os controles de exportação de GPU já falharam em conter o avanço, e proibir um modelo só prova que ele é competitivo o bastante para importar.

  • Duelo de geração de código com IA: GPT-5.6 Sol vs Kimi K3 vs Qwen3.8Max

    Três modelos frontier, um desafio brutal de programação: gerar um sistema solar cinematográfico em Three.js e um renderizador de cidade com 50 parâmetros em um único arquivo HTML. Veja quem venceu e teste as demos ao vivo.

  • Versão oficial do DeepSeek V4: o que 121 gray tests revelam sobre o desempenho em programação

    Revisamos 121 vídeos suspeitos de serem gray tests do DeepSeek V4, de 53 criadores, incluindo 40 sessões de programação compartilhadas. Veja o que as evidências sugerem sobre a versão oficial, seus limites e o DeepSeek V4 frente a Kimi K3, GPT-5.6 e Fable 5.0.

  • Guia de cota do Kimi K3: quanto dá pra usar? Limites de 5h, semanais e mensais

    Quanta cota a assinatura do Kimi K3 realmente oferece? Com base em dados reais de usuários do Allegretto, estimamos os limites de tokens por 5 horas, 7 dias e mensais dos planos Andante, Moderato, Allegretto e Allegro, além da cota do Kimi Code, dos preços da API e da comparação com o GPT-5.6 para ajudar você a escolher o plano certo.

  • DeepSeek V4 Gray-Release em mãos: 12 vídeos e links de compartilhamento verificáveis

    Vários usuários relatam que a API e o app web do DeepSeek estão em gray test de um modelo mais capaz. Reunimos 6 capturas de tela, 4 compartilhamentos oficiais do chat do DeepSeek, 9 logs da API do OpenCode e 12 vídeos — e avaliamos o quão bem 'um prompt, um jogo completo' funciona de verdade. A versão exata do modelo ainda não foi confirmada pelo DeepSeek.

  • Kimi K3 vaza em página de promoção de recarga: o que sabemos antes do lançamento oficial

    A Moonshot AI publicou por pouco tempo uma página de promoção de recarga do Kimi K3 em platform.kimi.com no dia 14 de julho de 2026, antes de retirá-la. O vazamento confirma o nome K3, sugere lançamento iminente (15 de julho – 11 de agosto) e revela bônus agressivos de recarga de 10-30%, mas o modelo K3 em si ainda não está disponível.

  • DeepSeek V4 oficial vazado: supera o Claude Opus 4.8 por 1/90 do preço

    A versão oficial do DeepSeek V4 vazou via gray release. Testadores independentes confirmam que ela supera o Claude Opus 4.8, ficando entre o Opus 4.8 e o Gemini 2.5 Pro. Gera jogos 3D completos a partir de um único prompt. O preço é 1/90 do Opus. Inclui 10 testes reais em vídeo do Bilibili.

  • O MiniMax está construindo um monstro de 3 trilhões de parâmetros — e isso pode mudar os preços de IA

    Notas internas vazadas revelam que o modelo de nova geração do MiniMax mira de 2,5 a 3 trilhões de parâmetros e adota a nova arquitetura MSA 2.0, que reduz drasticamente o custo de computação. Com acesso a GPUs no exterior e velocidade de inferência de 100 TPS, o MiniMax se consolida como o laboratório frontier mais rentável da China.

  • O mercado de modelos de IA está se dividindo em dois — veja como se posicionar

    Modelos baratos estão virando infraestrutura. Modelos frontier estão virando recursos escassos e regulados. O valor real não está nos modelos — está na camada de orquestração.

  • DeepSeek V4 introduz preços por pico: horários de pico custam o dobro

    O DeepSeek anunciou que os preços da API V4 vão dobrar durante o horário comercial (9:00–12:00 e 14:00–18:00, horário de Pequim). O lançamento oficial do V4 está previsto para meados de julho de 2026. Mesmo nos preços de pico, o DeepSeek segue sendo, com folga, a API de IA frontier mais barata.

  • Preços por horário do DeepSeek V4: o guia de arbitragem de API de IA

    A DeepSeek acaba de lançar a primeira precificação de API por pico/fora de pico do mundo. O fora de pico custa a metade — e, graças aos fusos horários, o pico de alguém é sempre o fora de pico de outro. Veja como aproveitar.

  • 4 ferramentas gratuitas para usar GLM 5.2 sem gastar um centavo

    O GLM 5.2 rivaliza com o Claude Sonnet 4 nos benchmarks de programação. Use-o gratuitamente por meio de 4 ferramentas chinesas para desenvolvedores: ZCode, Trae, Tabbit e CodeBuddy.