Veredito em poucas linhas

A DeepSeek não confirmou oficialmente que estes sejam o V4. O que temos em mãos é um volume grande e de consistência questionável de saídas suspeitas de um gray test: 121 vídeos no Bilibili publicados por 53 criadores entre 7 e 19 de julho de 2026, além de 40 sessões compartilhadas do OpenCode e alguns projetos para baixar. Esse volume dá para enxergar padrões, mas não para confirmar o ID do modelo ou rodar um benchmark controlado.

Com essa premissa em mente, a conclusão é clara: nas áreas em que Kimi K3, GPT-5.6 e Fable 5.0 brilham, o V4 fica um degrau abaixo — mas a diferença já é pequena o suficiente para que, na maior parte do dia a dia de código, um desenvolvedor focado em reduzir custo possa adotar o V4 como padrão e manter uma assinatura leve de modelo premium para code review, bugs cabeludos e os últimos 10% de tarefas longas com vários turnos.

Conclusão prática: essa versão suspeita do build não escreve código zero defeito. A mudança real é outra — consegue, a partir de uma única frase, transformar uma intenção vaga de produto em um web app que roda de verdade, e ainda corrige uma parte razoável dos próprios bugs. Esse é exatamente o divisor de águas entre "autocomplete" e "agent de implementação".

Para os prints e links de chat da onda anterior, veja nosso compilado de evidências do gray test do DeepSeek V4.

Catálogo completo de fontes Evidência-chave

A evidência original por trás de todas as conclusões deste artigo — espelhada do repositório open-source YunhaoFu/dsv4ga-news-gather. Expanda para filtrar por criador, data ou palavra-chave. O título leva direto ao Bilibili.

Clique para expandir os 136 registros 121 vídeos de teste + 15 notícias relacionadas

Dica: o título é o link do Bilibili. = sessão compartilhada, laranja = download do projeto. Passa o mouse sobre o criador para ver o nome completo.

#DataCriadorTítulo / Evidência
1 07-19 Bu Ai Qin Suspeito gray test da versão oficial do DeepSeek V4: pacote de shaders para Minecraft gerado com uma frase
2 07-19 Yizhi AI Fengxiangbiao Vazamento da versão oficial do DeepSeek V4, Opus 5 chega na próxima semana e pode ter sido treinado pelo Karpathy, JD.com lança JoyAI-Talker e Video-Edit | Informativo de IA de 19 de julho
3 07-19 Maoyi cat [Deepseek] O D-laoshi teve um colapso depois de aconselhar o usuário a não ter relacionamento com IA — e ainda montou esta coisa
4 07-19 Ai Chanpin Xiao Ding A versão oficial do DeepSeek V4 está chegando?
5 07-19 Jinhuazhong de Achen Kimi K3.1, DeepSeek V4 e Grok 4.6 solam novos vazamentos em sequência, enquanto a Fable 5 ainda limita o uso em 50%!
6 07-19 kdzzzds gray test ds — GTA5 em alta qualidade (sem buscar assets + SVG em uma rodada) 2.0
7 07-19 Shuaiqi de Silu Hai Shen Jie DeepseekV4: jogo estilo CS gerado com uma frase
8 07-19 Yue Yinyinyue Coletânea de vídeos de jogos gerados a partir de texto pela versão oficial do Deepseek v4
9 07-19 Xingguang yu Xue Versão oficial do DeepSeek v4 projeta e gera um redutor com uma frase
10 07-19 Xiaoli Wan Youxi_ A versão oficial do DeepSeek V4 está prestes a sair; quais os destaques?
11 07-19 Augenstern_-__- dsv4 gray test oficial — mais uma evolução
12 07-19 Gali Yu V4 nocauteia a FABLE; modelos chineses caçam sem trégua a Anthropic e a GPT
13 07-19 Xiao Xiao Xiao Ming Bushi Xiaoming Suspeito da versão oficial do DeepSeek V4: gera em duas frases uma página web de CFD gás-líquido (pouco realista)
14 07-19 Xiao Xiao Xiao Ming Bushi Xiaoming Versão oficial do DeepSeek V4: gere uma música eletrônica para mim [três faixas geradas via código strudel.cc]
15 07-19 Dongmian no Songshu_ Versão oficial do DeepSeek V4: Hearthstone
16 07-19 Beichen Polariss [deepseek v4 versão oficial] Brotato
17 07-19 Ye Zhi Ye Guiyi Teste de modelagem 3D do deepseek v4 pro versão oficial
18 07-19 Delight-linger Engenharia na prática? [dsv4 vs k3] Animação esquelética com física em 3D; a comparação é explosiva
19 07-19 Beichen Polariss [deepseek v4 versão oficial] Fruit Ninja
20 07-19 UPLUZ [Suspeito da versão oficial do DeepSeek] Simulação de desastre, evoluiu ainda mais do que vimos há poucos dias
21 07-19 Xichang shang de Lao Jiangjun Versão oficial do deepseekv4: buraco negro gerado a partir de um único prompt
22 07-19 bili_3493108501187431 Versão final do War Thunder gerada pelo deepseekv4 oficial
23 07-18 -_yi_-_yi- Mapa de grande estratégia que o GPT 5.6 Sol (concorrente da versão oficial do deepseek) levou muitas frases para implementar
24 07-18 PotnQ É de assustar: o DSV4 em gray test iterou um jogo centenas de vezes
25 07-18 Xichang shang de Lao Jiangjun Versão oficial do deepseekv4: Minecraft com raio de visão de 8.192 chunks
26 07-18 UPLUZ [Suspeito da versão oficial do DeepSeek] Afinal, quem é o rei dos modelos? (reclinando taticamente)
27 07-18 Yizhi AI Fengxiangbiao Gray test da versão oficial do DeepSeek V4, Grok 4.6 do Musk entra em teste na próxima semana, Intern-S2 do Laboratório de IA de Shanghai bate o Opus 4.8 | Informativo de IA de 18 de julho
28 07-18 UPLUZ [Suspeito da versão oficial do DeepSeek] Redesenhamos o Flappy Bird com o D-laoshi
29 07-18 cacl2_lhg Versão oficial do DeepSeek V4 em gray test: carroça estilo Minecraft (com várias pistas diferentes)
30 07-18 Yuzhibo Huaren Mini-jogo feito com deepseek: San Guo Dou Fei Ji!!!
31 07-18 Menghui 0 Versão oficial do dsv4 recria Starfield com 1.000 planetas e pouso/aterrissagem sem costura — Todd, a DeepSeek realizou o seu sonho!
32 07-18 Ai Moyu de Yuemeng [Dublagem BR] A Anthropic esfria | Kimi K3.1, Grok 4.6, DeepSeek v4 versão oficial, modelo Gold Eagle do governo dos EUA, e MMA de robôs
33 07-18 Chilin Fangzhen 2 Hao Gray test do deepseek: jogabilidade de Earth Defense Force
34 07-18 bili_3493108501187431 War Thunder otimizado gerado pela versão oficial do deepseekv4
35 07-18 Guigu Shenqi Perrengue na Anthropic... Kimi K3.1, Grok 4.6, DeepSeek v4 versão oficial, programa "Águia Dourada" do governo dos EUA, e MMA de robôs!
36 07-18 Shantou Xiaoyao Progresso de um dia desenvolvendo jogo com deepseek (novo jogo em produção: Fortaleza do Apocalipse contra inimigos)
37 07-18 Aki_2519 [Suspeito da versão oficial do deepseek v4] Geração de jogo estilo Teardown
38 07-18 UPLUZ [Suspeito da versão oficial do DeepSeek] Isso sim é música de verdade.jpg②
39 07-18 Zidian (gray test) Versão oficial do DeepSeek gera Dead Cells de uma só vez
40 07-18 Xiao Xiao Xiao Ming Bushi Xiaoming Sequência do teste de suspensão double-wishbone: ninguém pode difamar a V4 oficial
41 07-18 Yanshendian Dianzhu Reordenamento total da IA! A Anthropic cai do pódio; Kimi K3.1, Grok 4.6 e DeepSeek v4 em treta generalizada, mais o programa Águia Dourada e o MMA de robôs
42 07-18 TwoShenMengxi Versão oficial do deepseek: No Man's Sky x Minecraft (atualmente com crash)
43 07-18 Delight-linger [dsv4 oficial] Recria [Simulador de Lan House] em uma frase usando Godot e C#
44 07-18 UPLUZ [Suspeito da versão oficial do DeepSeek] Choque sentado! Ele ainda fez o Beat Saber!
45 07-18 Gangjing MrS deepseekv4pro max, suspeito gray test da versão oficial: gera Metal Slug com uma frase; o motor também é escrito pelo próprio, impressionante
46 07-18 Chire de Gangtie Suspeito gray test da versão oficial do deepseek-v4-pro! Com uma frase fez o Dafeiyu produzir 5 faixas de música eletrônica!
47 07-18 Ye Zhi Ye Guiyi Teste do deepseek V4 oficial
48 07-18 kdzzzds gray test ds: Minecraft 8.192 chunks de raio de visão, 1 rodada + 2 rodadas de correção de bug
49 07-18 Yuxia Bing Wutong Deixa eu falar com toda sinceridade: DEEPSEEK V4 gray test oficial é excelente, impressionante, de altíssimo nível — mas não é perfeito, ainda tem BUG. Esta é a verdade mais sincera, e não aceito réplica.
50 07-18 Yidian de Yatuoli [Suspeito da versão oficial do deepseekv4] O Beethoven da IA — teste de geração de várias músicas
51 07-18 -Wenli- Suspeito gray test do deepseekv4: só fornece parte dos assets, o restante é gerado pela própria IA; lógica de primeira, na segunda ajustou o estilo visual
52 07-18 Xiao Xiao Xiao Ming Bushi Xiaoming Simulação do ronco do V8, soa melhor que Forza Horizon; gerado pelo DS V4 gray test
53 07-18 Kangkang Bushuo Saohua Neon Ronin — deepseek solta uma versão num único turno
54 07-18 Yucunzhang 233 Gray test da versão oficial do Deepseekv4: criação de música e emulador de NES
55 07-18 Yuxia Bing Wutong Mini-jogo de página única "Mundo de Blocos": desta vez não vou surfar na onda do DEEPSEEK V4 gray test oficial, deixo o clickbait de lado e vamos aos dados reais.
56 07-18 kdzzzds Versão gray do dsv4 (modelagem própria do ds): CS:GO modo deathmatch + desativação de bomba
57 07-18 Guozhihe Summer Recriação de Punishing: Gray Raven com DeepSeek (suspeito da versão oficial)
58 07-18 stupid_scout Versão oficial do DeepseekV4: jogo estilo Battlefield totalmente reformulado, com bastante conteúdo novo (link de download nos comentários)
59 07-18 LikrFG Teste do modelo suspeito da versão oficial do deepseek v4
60 07-18 Xiao Xiao Xiao Ming Bushi Xiaoming Tem V8! Dois jogos no DS v4 oficial [Mario e corrida]; atualização rápida nº 4 — só jogando e compartilhando
61 07-18 Tianxing_tianxing Versão oficial do deepseek: mini-jogo feito por 4 yuans
62 07-18 Limeng aajjkk Versão oficial do DeepSeekv4pro: teste de 4.000 bolinhas geradas em uma frase, perfeito sem bug (modo max), com benchmark de desempenho.
63 07-17 Dongmian no Songshu_ Versão oficial do DeepSeek V4: Delta Force e The Forest
64 07-17 Xiao Xiao Xiao Ming Bushi Xiaoming DS v4 oficial em uma frase: [ferramenta de tradução de screenshot, jogo indie selecionado]; atualização rápida nº 3 — só jogando e compartilhando
65 07-17 Qilin1132 Quando você pede ao gray test oficial do deepseek v4 e à versão preview para fazer o mesmo jogo
66 07-17 Menghui 0 Versão oficial do deepseek v4: produzir jogo de corrida estilo kart
67 07-17 Fengwei Guangmao [Touhou Project] Comparação do DeepSeek suspeito em gray test vs preview: gera jogo bullet hell em uma frase
68 07-17 kdzzzds gray dsv4 — GTA em altíssima qualidade (sem assets externos, modelagem própria): 1 rodada + 1 rodada de correção de bug
69 07-17 Augenstern_-__- v4 gray test oficial — comparação de duas versões front-end
70 07-17 Meiyou Shezhi Yi deepseek open-sourceou o Claude Fable 5 ☝️
71 07-17 Xingguang yu Xue Versão oficial do DeepSeek v4 recria Kingdom: Two Crowns em vários turnos de diálogo
72 07-17 Hei Tao Animação da ópera Carmen feita à mão pela versão oficial do DeepseekV4
73 07-17 s Jiushi Zheyang s Suspeito gray test do DS V4 oficial: chorei de susto com o resultado; é a melhor versão que já vi da fusão Minecraft + No Man's Sky
74 07-17 kdzzzds Vem ver o enorme potencial escondido do front-end do v4 gray test (prompt gerado pela IA)
75 07-17 DaVinci-2nd Para quem ainda não pegou o gray test da versão oficial do dsV4 ou pegou e deu crash
76 07-17 kdzzzds Obra nuclear — suspeito gray test da versão oficial do dsv4: Minecraft / Outer Wilds, bloco de curvatura
77 07-17 e4glet DeepSeek 3D Walkman player
78 07-17 Maoyi cat [Vibecoding] Um solzinho tocável feito em conjunto por Claude e Deepseek
79 07-17 Yi Shuang Diantai Musk comenta sobre o Kimi k3! Só digo: deepseek NO1
80 07-17 Langji Tianya Ren free Gray test da versão oficial do deepseek fazendo Thunder Fighter
81 07-17 kdzzzds Quem ousa questionar o esteta do D-laoshi — suspeito gray dsv4 fazendo Minecraft só com imagens SVG
82 07-17 -Wenli- Gray test da versão oficial do deepseek v4: Minecraft + Spore, segunda revisão
83 07-17 Xingguang yu Xue Versão oficial do DeepSeek v4 gera Sky: Children of the Light em vários turnos de diálogo
84 07-17 kdzzzds Suspeito gray dsv4 — Meu Espaço Profundo: fortalecendo o prompt de arte sobre o prompt original para ver o efeito (sem acesso à web)
85 07-17 Aierkuide de Situ Gray test oficial do DeepSeek v4 + geração com Z-image: Gwent acadêmico
86 07-17 Xiao Xiao Xiao Ming Bushi Xiaoming Teste nº 2! Avaliação profunda e completa do DeepSeek V4 oficial, com kimiK3 junto
87 07-17 Ye Zhi Ye Guiyi Teste do deepseek v4 oficial
88 07-17 Ye Zhi Ye Guiyi Teste do deepseek v4 oficial: gera jogo em uma frase
89 07-17 -Wenli- Suspeito gray test da versão oficial do dsv4: Minecraft + Spore
90 07-17 Dongmian no Songshu_ DeepSeek V4: World of Warcraft, remasterização em HD
91 07-17 Delight-linger Dois sóis no céu! Teste comparativo entre K3 e Deepseekv4 (gray test oficial)
92 07-16 kdzzzds Teste não rigoroso
93 07-16 PotnQ Gray test da versão oficial do DSV4: No Man's Sky com pouso pseudo sem costura
94 07-16 Tanguizhe Xiqian Versão oficial do Deepseekv4: jogabilidade de My Space Program, pouso suave na Lua
95 07-16 Dongmian no Songshu_ Versão oficial do DeepSeek V4: gera World of Warcraft em vários turnos de diálogo
96 07-16 UPLUZ [Suspeito da versão oficial do DeepSeek] Flappy Bird — comparação de efeitos preview vs oficial
97 07-16 stupid_scout Versão oficial do DeepseekV4: teste de Portal (a implementação ficou muito boa! Mais alguns testes de problemas de portal)
98 07-16 Hei Tao Versão oficial do DeepseekV4 gera Ace Attorney!
99 07-16 Luobida Shiyanshi O desempenho do Kimi K3 é absurdo! Vem aí outro "DeepSeek moment"? Inteligência Artificial
100 07-16 cacl2_lhg Suspeito mini-jogo estilo Mario Kart gerado pela versão oficial do Deepseek V4
101 07-16 Augenstern_-__- v4 gray test oficial: teste de animação de disparo de arco em SVG
102 07-16 stupid_scout Versão oficial do DeepseekV4: só pedi para remover comentários e ele de quebra corrigiu o bug do jogo
103 07-16 s Jiushi Zheyang s Suspeito fragmento de espaço de alta dimensão, gray test da versão oficial do Deepseek: gera Forza Horizon 6 em uma frase
104 07-16 Menghui 0 Versão oficial do deepseek v4 gera web game estilo Sekiro
105 07-16 stupid_scout Jogo estilo Battlefield gerado pela versão oficial do DeepseekV4 (o efeito é absurdo!!)
106 07-16 Ba Bixu Xu 112 [Mais recente em julho] De graça! DeepSeek V4 versão livre gratuita, sem limite de uso!
107 07-16 Sanshi Dingni dsv4 gera rhythm game de notas que caem com música personalizável
108 07-16 Delight-linger Explosão nuclear: dsv4 oficial gera vários jogos Android de uma só vez — parkour, RA, ação 2D, etc.
109 07-16 UPLUZ [Suspeito da versão oficial do DeepSeek] Besiege: a simulação física é muito boa
110 07-16 Feiyue Maidanglao Gray test da versão oficial do deepseek v4: gera jogo de terror
111 07-16 Fan Gang Jiulong [Touhou] Deepseek-v4 versão oficial (suspeito) gray test gera de uma vez — Crônicas Mecânicas de Touhou
112 07-16 Augenstern_-__- dsv4 gray test oficial — corrige os dois primeiros episódios e mostra Mount & Blade
113 07-16 Augenstern_-__- Suspeito gray test da versão oficial do dsv4 — Backrooms
114 07-16 Augenstern_-__- Suspeito gray test da versão oficial do dsv4 — o jogo de terror japonês com mais atmosfera; comparação preview vs oficial
115 07-15 UPLUZ [Suspeito da versão oficial do DeepSeek] Mundo de Zelda
116 07-15 Delight-linger Versão oficial do Deepseekv4: Kerbal Space Program + Minecraft — pouso na Lua na prática (hard landing), 3 turnos de diálogo
117 07-15 Zuoshou Ajiu Jogo de sobrevivência gerado em uma frase pelo deepseekV4pro
118 07-15 Fan Gang Jiulong Suspeito gray test da versão oficial do dsv4 — Minecraft x No Man's Sky
119 07-15 Delight-linger Gray test da versão oficial do Deepseek: Raft + Minecraft (meu jogo de jangada)
120 07-15 Qitian Dasheng wy Deepseek, o que foi que esse Dafeiyu fez?
121 07-15 Tongshui test-2 Chocado com o deepseek
122 07-15 kdzzzds Suspeito gray test da versão oficial do deepseekv4 — Minecraft + No Man's Sky (áudio baixo)
123 07-14 kdzzzds (com crash) Suspeito gray test da versão oficial do dsv4 — Twilight Forest (parou no meio)
124 07-14 kdzzzds Suspeito gray test da versão oficial do deepseekv4 — The King of Fighters
125 07-14 kdzzzds Suspeito gray test da versão oficial do deepseek v4 — teste de terreno do Nether e do End no Minecraft (terreno gerado de uma vez)
126 07-14 kdzzzds Suspeito gray test da versão oficial do deepseekv4 — No Man's Sky
127 07-13 2258ppq Versão oficial do dsv4 — teste 2
128 07-11 Bukoyi Baohan Teshu Zifu Gray test da versão oficial do DeepSeek 4.0: desenvolvimento de mini-jogo
129 07-10 Feiyue Maidanglao Não sei se fui contemplado pelo gray test da versão oficial do deepseek v4; gerado com uma frase, mas o resultado é realmente bom
130 07-09 Dongmian no Songshu_ Versão oficial do DeepSeek V4 gera Backrooms e jogo de terror em uma frase
131 07-09 Xiao Xiao Xiao Ming Bushi Xiaoming A joia nacional evolui de novo! Avaliação rápida do DeepSeek V4 oficial, com comparativo direto de Gemini 3.5 Pro / Grok 4.5 etc.
132 07-09 Delight-linger Gray test da versão oficial do dsv4? Terraria + Isaac + RTS + sistema operacional no navegador + Cut the Rope + Stardew Valley — todos testados
133 07-08 Dongmian no Songshu_ Gray test: versão oficial do DeepSeek V4 gera GTA5 em uma frase
134 07-07 Dongmian no Songshu_ Versão oficial do DeepSeek V4 gera CS:GO em uma frase (registro de geração transparente)
135 07-07 Dongmian no Songshu_ Versão oficial do DeepSeek V4 gera Minecraft
136 07-06 System-Win-FUN Bug grave no Deepseek: ao responder perguntas há uma chance de ficar repetindo "recebido".

O que os 121 testes revelam

Os dados vêm do projeto open-source dsv4ga-news-gather, que indexa vídeos públicos do Bilibili mantendo título, criador, timestamp, descrição, comentários, sessões compartilhadas e links de download. O snapshot de 19 de julho mostra, em linhas gerais:

121vídeos de gray test
53criadores independentes
40sessões compartilhadas
12janela de dias (7/7–7/19)

Publicações por dia

Vazamentos esporádicos antes de 15 de julho, com explosão concentrada em seguida e pico em 18 de julho.

7/6
1
7/7
2
7/8
1
7/9
3
7/10
1
7/11
1
7/13
1
7/14
4
7/15
8
7/16
23
7/17
29
7/18
40
7/19
22

Top 10 criadores

Entre os dez primeiros, só kdzzzds e Delight-linger publicaram um volume grande de sessões. Verde = 5 ou mais sessões compartilhadas, laranja = 1–4, azul = nenhuma.

kdzzzds
14· 12 sessões
Xiao Xiao Xiao Ming
8· sem sessões
Dongmian no Songshu_
8· sem sessões
UPLUZ
8· sem sessões
Delight-linger
7· 11 sessões
Augenstern_-__-
6· 1 sessão
Ye Zhi Ye Guiyi
4· sem sessões
stupid_scout
4· sem sessões
Xingguang yu Xue
3· sem sessões
Menghui 0
3· sem sessões

O que as pessoas estão testando de fato

Classificação por título dos 136 registros. Jogos dominam de forma absoluta — backend de produção, segurança e projetos de longo ciclo quase não aparecem.

Outros jogos / protótipos
4332%
Voxel / Minecraft
1712%
Cartas / RPG / arcade
1712%
Física / simulação espacial
129%
Tiro / militar
118%
Música / áudio
107%
Corrida / mundo aberto
86%
Notícia / review
75%
Terror
54%
Chat / brincadeira
32%
Ferramenta / teste de motor
32%

Dois vieses importam mais do que qualquer número isolado. Viés de seleção: a maioria é "programação por desejo" — jogos no navegador, cenários 3D, animações em SVG, mini-brincadeiras com física, ferramentas musicais. Por isso, esse conjunto é uma evidência forte para prototipação rápida e geração de front-end, mas quase não diz nada sobre backend de produção, segurança, manutenção de monorepos grandes ou projetos com ciclos de vários meses. Viés de transparência: só 3 dos dez principais criadores compartilharam prompts ou logs de sessão. Dizer "versão oficial" no título é puro clickbait — os criadores em geral também só foram supostamente contemplados pelo gray test. Ao longo de todo o texto usamos a expressão versão suspeita do V4 em gray test.

No que o V4 parece ser bom

App de uma frase agora roda de verdade, não serve só para olhar

O padrão mais marcante é a geração de implementação completa a partir de uma especificação curta. No conjunto há mundos voxel, jogos de tiro, rhythm games, de sobrevivência, cenas em three.js, geradores de música e visualizações de engenharia. Um demo em SVG estilo GTA representativo foi, segundo a descrição, uma geração principal + uma rodada de correção de bug, e tem sessão compartilhada. Não é "uma frase entrega um jogo"; é "o modelo escolhe a arquitetura, costura subsistemas razoáveis para demonstrar a ideia e não regredir para um mockup oco".

Código 3D, SVG e simulações leves ficaram mais fortes

Cenas em three.js, assets SVG customizados, física de jogos e simulações interativas aparecem o tempo todo. Uma página web estilo CFD gás-líquido supostamente usa PBF para líquidos e LBM para gases, em duas rodadas de diálogo. O próprio criador aponta que a aerodinâmica não é realista e segue precisando de ajustes — exatamente a fronteira entre "protótipo impressionante" e "ferramenta de engenharia confiável".

O preço pode ser o verdadeiro headline

As comparações da comunidade descrevem o V4 e o Kimi K3 como próximos em projetos reais. Se a API final mantiver a vantagem histórica de preço da DeepSeek, "oferecer capacidade quase de fronteira pelo preço de infraestrutura" importa mais do que vencer qualquer demo head-to-head. Veja nossa comparação de preços de API de IA.

Onde o V4 ainda vacila

  • Gosto e acabamento. Em composição de front-end e textos longos, a comunidade costuma preferir o Kimi K3. O visual do V4 pode ser impressionante, mas a qualidade varia muito conforme o design do prompt.
  • Limites da instrução. Num demo, pediram ao modelo para remover comentários e ele, de quebra, corrigiu o bug do jogo. Esse tipo de iniciativa é mágico em brinquedos — e risco de revisão em repositório real. Cada diff precisa ser lido; não confunda "roda" com "aprovado".
  • Confiabilidade em sessões longas de vários turnos. As sessões ainda quebram, saem dos trilhos ou acumulam dívida de arquitetura depois de vários turnos. Ser forte na primeira vez não garante ser forte na vigésima.
  • Corretude física. Uma simulação de fluido ou de gravidade que parece certa não é um CFD ou mecânica válida. Visual certo ≠ valor numérico certo.
  • Reprodutibilidade. O roteamento do gray test parece instável. Usuários diferentes podem ter atingido modelos, tiers ou comportamentos de sampling diferentes.
  • Qualidade da evidência. Muitos vídeos não trazem prompt completo, identificação do modelo, número de falhas, uso de tokens nem edições manuais.

A descrição honesta é "gerador de protótipos com teto alto e capacidade real de programação" — não "engenheiro sênior que dispensa revisão".

V4 vs Kimi K3 vs GPT-5.6 vs Fable 5.0

Não existe aqui um benchmark controlado de quatro modelos. A tabela abaixo é uma síntese orientada a fluxo de trabalho, baseada em evidências do gray test e em feedback de usuários — não é um ranking.

ModeloPossíveis vantagensPosição do V4Melhor papel
DeepSeek V4custo, implementação ampla, protótipo rápidolinha de basecódigo padrão do dia a dia e primeira implementação
Kimi K3acabamento de front-end, apresentação, textoV4 um degrau abaixo no acabamento, mas equivalente em funcionalidade na maioria dos casosotimização de UI, texto de produto, refinamento visual
GPT-5.6consistência de revisão, ecossistema de ferramentas, raciocínio entre arquivosno trabalho de rotina o V4 é a alternativa mais barata; não há evidência suficiente de vitória geralcode review, validação, bugs teimosos
Fable 5.0implementação de ciclo longo, recuperação em vários turnosem demos selecionadas o V4 parece próximo, mas tem estabilidade de borda menormodelo de upgrade para a parte mais difícil

V4 vs Kimi K3: o material direto mais confiável aponta para um embate equilibrado. Em front-end e texto o K3 parece melhor; o V4 tem custo-benefício superior e é competitivo na implementação. Um vídeo de comparação chegou a dezenas de milhares de views, mas prompt e pontuação não foram padronizados.

V4 vs GPT-5.6: comentários isolados afirmam que em alguns projetos web um ganha do outro. Isso é inspiração para teste, não resultado de benchmark. A pergunta útil de verdade é: o V4 consegue rodar a suíte de testes do seu repositório a um custo menor?

V4 vs Fable 5.0: demos de jogos impressionantes tornam a comparação tentadora, mas esse conjunto não basta para sustentar que o V4 empata em código grande, auditoria de segurança ou execução autônoma por longo tempo. Até que testes reprodutíveis mostrem o contrário, trate o Fable 5.0 como opção de upgrade.

Recomendação prática

A configuração mais barata e que não te queima:

  1. Deixe o V4 fazer os primeiros 80–90%. Planejamento, scaffold, implementação, testes, documentação, correção de bug de rotina.
  2. Valide localmente. Lint, checagem de tipos, testes unitários e de integração, mais revisão humana de diff. Inegociável.
  3. Suba com evidência. Quando travar, mande o diff, os testes que falharam e o problema específico para o Kimi K3, GPT-5.6 ou Fable 5.0 — não reenvie o mesmo prompt vago.
  4. Mantenha uma assinatura leve de modelo premium, não várias integrais. Use-a como revisor e modelo de resgate, não como consumidor padrão de tokens.
Recomendado: V4 como modelo de implementação de alto throughput, somado a uma assinatura leve premium para code review independente e para problemas que vários turnos não resolveram.

Essa configuração só funciona quando o segundo modelo recebe evidência (diff, logs, testes falhando). Perguntar o mesmo prompt vago a dois modelos em geral só dobra o custo, sem ganhar confiabilidade.

O que validar no lançamento oficial

A versão oficial precisa ser julgada por reprodutibilidade, não por demo de lançamento. Verifique:

  • o ID exato do modelo na API, e se web, app e API usam o mesmo tier;
  • janela de contexto, limite de saída, suporte a chamada de ferramentas e saída estruturada;
  • preço por token de entrada, de entrada em cache e de saída;
  • rate limit, roteamento em pico, e se os tiers "Pro/Flash/Max" se comportam de forma diferente;
  • edição em nível de repositório, conclusão de testes e aderência a instruções;
  • probabilidade de reproduzir a qualidade do gray test com o mesmo prompt;
  • licenciamento, retenção de dados e opções de implantação.

Assim que a DeepSeek publicar o model card oficial, a documentação da API e o preço, atualizamos este texto. Até lá, qualquer afirmação sobre o modelo final é provisória.

Perguntas frequentes

A versão oficial já está disponível?

Este conjunto de dados registra roteamento suspeito de gray test, não um lançamento confirmado. Dizer "versão oficial" no título do vídeo não equivale a confirmação oficial da DeepSeek.

Como é, afinal, a capacidade de programação do V4?

A evidência é mais forte em protótipos web rápidos, jogos, SVG, three.js e correção iterativa de bugs; é mais fraca em monorepos de produção grandes, código sensível a segurança e tarefas automáticas de longa duração.

O V4 é mais forte que o Kimi K3?

Não em todas as tarefas. O V4 parece próximo e pode ter custo-benefício melhor; o Kimi K3 costuma levar no acabamento de front-end e em texto. Decida rodando com o mesmo prompt, mesmo runtime e mesmos critérios de aceitação.

Devo cancelar minha assinatura premium de código?

Para muita gente, reduzir a uma assinatura leve premium faz mais sentido do que cancelar tudo. Deixe o V4 carregar o volume e mantenha um modelo independente para revisão e upgrade.

Onde ver o gray test original?

Comece pelo índice no GitHub com os 121 vídeos. Casos representativos: teste em largura do V4 vs Kimi K3, comparativo de física 3D, teste de Minecraft com 8.192 chunks, caso de correção espontânea de bug.