Veredito em poucas linhas
A DeepSeek não confirmou oficialmente que estes sejam o V4. O que temos em mãos é um volume grande e de consistência questionável de saídas suspeitas de um gray test: 121 vídeos no Bilibili publicados por 53 criadores entre 7 e 19 de julho de 2026, além de 40 sessões compartilhadas do OpenCode e alguns projetos para baixar. Esse volume dá para enxergar padrões, mas não para confirmar o ID do modelo ou rodar um benchmark controlado.
Com essa premissa em mente, a conclusão é clara: nas áreas em que Kimi K3, GPT-5.6 e Fable 5.0 brilham, o V4 fica um degrau abaixo — mas a diferença já é pequena o suficiente para que, na maior parte do dia a dia de código, um desenvolvedor focado em reduzir custo possa adotar o V4 como padrão e manter uma assinatura leve de modelo premium para code review, bugs cabeludos e os últimos 10% de tarefas longas com vários turnos.
Conclusão prática: essa versão suspeita do build não escreve código zero defeito. A mudança real é outra — consegue, a partir de uma única frase, transformar uma intenção vaga de produto em um web app que roda de verdade, e ainda corrige uma parte razoável dos próprios bugs. Esse é exatamente o divisor de águas entre "autocomplete" e "agent de implementação".
Para os prints e links de chat da onda anterior, veja nosso compilado de evidências do gray test do DeepSeek V4.
Catálogo completo de fontes Evidência-chave
A evidência original por trás de todas as conclusões deste artigo — espelhada do repositório open-source YunhaoFu/dsv4ga-news-gather. Expanda para filtrar por criador, data ou palavra-chave. O título leva direto ao Bilibili.
Clique para expandir os 136 registros
121 vídeos de teste + 15 notícias relacionadas
Dica: o título é o link do Bilibili. verde = sessão compartilhada, laranja = download do projeto. Passa o mouse sobre o criador para ver o nome completo.
| # | Data | Criador | Título / Evidência |
| 1 |
07-19 |
Bu Ai Qin |
Suspeito gray test da versão oficial do DeepSeek V4: pacote de shaders para Minecraft gerado com uma frase
|
| 2 |
07-19 |
Yizhi AI Fengxiangbiao |
Vazamento da versão oficial do DeepSeek V4, Opus 5 chega na próxima semana e pode ter sido treinado pelo Karpathy, JD.com lança JoyAI-Talker e Video-Edit | Informativo de IA de 19 de julho
|
| 3 |
07-19 |
Maoyi cat |
[Deepseek] O D-laoshi teve um colapso depois de aconselhar o usuário a não ter relacionamento com IA — e ainda montou esta coisa
|
| 4 |
07-19 |
Ai Chanpin Xiao Ding |
A versão oficial do DeepSeek V4 está chegando?
|
| 5 |
07-19 |
Jinhuazhong de Achen |
Kimi K3.1, DeepSeek V4 e Grok 4.6 solam novos vazamentos em sequência, enquanto a Fable 5 ainda limita o uso em 50%!
|
| 6 |
07-19 |
kdzzzds |
gray test ds — GTA5 em alta qualidade (sem buscar assets + SVG em uma rodada) 2.0
|
| 7 |
07-19 |
Shuaiqi de Silu Hai Shen Jie |
DeepseekV4: jogo estilo CS gerado com uma frase
|
| 8 |
07-19 |
Yue Yinyinyue |
Coletânea de vídeos de jogos gerados a partir de texto pela versão oficial do Deepseek v4
|
| 9 |
07-19 |
Xingguang yu Xue |
Versão oficial do DeepSeek v4 projeta e gera um redutor com uma frase
|
| 10 |
07-19 |
Xiaoli Wan Youxi_ |
A versão oficial do DeepSeek V4 está prestes a sair; quais os destaques?
|
| 11 |
07-19 |
Augenstern_-__- |
dsv4 gray test oficial — mais uma evolução
|
| 12 |
07-19 |
Gali Yu |
V4 nocauteia a FABLE; modelos chineses caçam sem trégua a Anthropic e a GPT
|
| 13 |
07-19 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Suspeito da versão oficial do DeepSeek V4: gera em duas frases uma página web de CFD gás-líquido (pouco realista)
|
| 14 |
07-19 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Versão oficial do DeepSeek V4: gere uma música eletrônica para mim [três faixas geradas via código strudel.cc]
|
| 15 |
07-19 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4: Hearthstone
|
| 16 |
07-19 |
Beichen Polariss |
[deepseek v4 versão oficial] Brotato
|
| 17 |
07-19 |
Ye Zhi Ye Guiyi |
Teste de modelagem 3D do deepseek v4 pro versão oficial
|
| 18 |
07-19 |
Delight-linger |
Engenharia na prática? [dsv4 vs k3] Animação esquelética com física em 3D; a comparação é explosiva
|
| 19 |
07-19 |
Beichen Polariss |
[deepseek v4 versão oficial] Fruit Ninja
|
| 20 |
07-19 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Simulação de desastre, evoluiu ainda mais do que vimos há poucos dias
|
| 21 |
07-19 |
Xichang shang de Lao Jiangjun |
Versão oficial do deepseekv4: buraco negro gerado a partir de um único prompt
|
| 22 |
07-19 |
bili_3493108501187431 |
Versão final do War Thunder gerada pelo deepseekv4 oficial
|
| 23 |
07-18 |
-_yi_-_yi- |
Mapa de grande estratégia que o GPT 5.6 Sol (concorrente da versão oficial do deepseek) levou muitas frases para implementar
|
| 24 |
07-18 |
PotnQ |
É de assustar: o DSV4 em gray test iterou um jogo centenas de vezes
|
| 25 |
07-18 |
Xichang shang de Lao Jiangjun |
Versão oficial do deepseekv4: Minecraft com raio de visão de 8.192 chunks
|
| 26 |
07-18 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Afinal, quem é o rei dos modelos? (reclinando taticamente)
|
| 27 |
07-18 |
Yizhi AI Fengxiangbiao |
Gray test da versão oficial do DeepSeek V4, Grok 4.6 do Musk entra em teste na próxima semana, Intern-S2 do Laboratório de IA de Shanghai bate o Opus 4.8 | Informativo de IA de 18 de julho
|
| 28 |
07-18 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Redesenhamos o Flappy Bird com o D-laoshi
|
| 29 |
07-18 |
cacl2_lhg |
Versão oficial do DeepSeek V4 em gray test: carroça estilo Minecraft (com várias pistas diferentes)
|
| 30 |
07-18 |
Yuzhibo Huaren |
Mini-jogo feito com deepseek: San Guo Dou Fei Ji!!!
|
| 31 |
07-18 |
Menghui 0 |
Versão oficial do dsv4 recria Starfield com 1.000 planetas e pouso/aterrissagem sem costura — Todd, a DeepSeek realizou o seu sonho!
|
| 32 |
07-18 |
Ai Moyu de Yuemeng |
[Dublagem BR] A Anthropic esfria | Kimi K3.1, Grok 4.6, DeepSeek v4 versão oficial, modelo Gold Eagle do governo dos EUA, e MMA de robôs
|
| 33 |
07-18 |
Chilin Fangzhen 2 Hao |
Gray test do deepseek: jogabilidade de Earth Defense Force
|
| 34 |
07-18 |
bili_3493108501187431 |
War Thunder otimizado gerado pela versão oficial do deepseekv4
|
| 35 |
07-18 |
Guigu Shenqi |
Perrengue na Anthropic... Kimi K3.1, Grok 4.6, DeepSeek v4 versão oficial, programa "Águia Dourada" do governo dos EUA, e MMA de robôs!
|
| 36 |
07-18 |
Shantou Xiaoyao |
Progresso de um dia desenvolvendo jogo com deepseek (novo jogo em produção: Fortaleza do Apocalipse contra inimigos)
|
| 37 |
07-18 |
Aki_2519 |
[Suspeito da versão oficial do deepseek v4] Geração de jogo estilo Teardown
|
| 38 |
07-18 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Isso sim é música de verdade.jpg②
|
| 39 |
07-18 |
Zidian |
(gray test) Versão oficial do DeepSeek gera Dead Cells de uma só vez
|
| 40 |
07-18 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Sequência do teste de suspensão double-wishbone: ninguém pode difamar a V4 oficial
|
| 41 |
07-18 |
Yanshendian Dianzhu |
Reordenamento total da IA! A Anthropic cai do pódio; Kimi K3.1, Grok 4.6 e DeepSeek v4 em treta generalizada, mais o programa Águia Dourada e o MMA de robôs
|
| 42 |
07-18 |
TwoShenMengxi |
Versão oficial do deepseek: No Man's Sky x Minecraft (atualmente com crash)
|
| 43 |
07-18 |
Delight-linger |
[dsv4 oficial] Recria [Simulador de Lan House] em uma frase usando Godot e C#
|
| 44 |
07-18 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Choque sentado! Ele ainda fez o Beat Saber!
|
| 45 |
07-18 |
Gangjing MrS |
deepseekv4pro max, suspeito gray test da versão oficial: gera Metal Slug com uma frase; o motor também é escrito pelo próprio, impressionante
|
| 46 |
07-18 |
Chire de Gangtie |
Suspeito gray test da versão oficial do deepseek-v4-pro! Com uma frase fez o Dafeiyu produzir 5 faixas de música eletrônica!
|
| 47 |
07-18 |
Ye Zhi Ye Guiyi |
Teste do deepseek V4 oficial
|
| 48 |
07-18 |
kdzzzds |
gray test ds: Minecraft 8.192 chunks de raio de visão, 1 rodada + 2 rodadas de correção de bug
|
| 49 |
07-18 |
Yuxia Bing Wutong |
Deixa eu falar com toda sinceridade: DEEPSEEK V4 gray test oficial é excelente, impressionante, de altíssimo nível — mas não é perfeito, ainda tem BUG. Esta é a verdade mais sincera, e não aceito réplica.
|
| 50 |
07-18 |
Yidian de Yatuoli |
[Suspeito da versão oficial do deepseekv4] O Beethoven da IA — teste de geração de várias músicas
|
| 51 |
07-18 |
-Wenli- |
Suspeito gray test do deepseekv4: só fornece parte dos assets, o restante é gerado pela própria IA; lógica de primeira, na segunda ajustou o estilo visual
|
| 52 |
07-18 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Simulação do ronco do V8, soa melhor que Forza Horizon; gerado pelo DS V4 gray test
|
| 53 |
07-18 |
Kangkang Bushuo Saohua |
Neon Ronin — deepseek solta uma versão num único turno
|
| 54 |
07-18 |
Yucunzhang 233 |
Gray test da versão oficial do Deepseekv4: criação de música e emulador de NES
|
| 55 |
07-18 |
Yuxia Bing Wutong |
Mini-jogo de página única "Mundo de Blocos": desta vez não vou surfar na onda do DEEPSEEK V4 gray test oficial, deixo o clickbait de lado e vamos aos dados reais.
|
| 56 |
07-18 |
kdzzzds |
Versão gray do dsv4 (modelagem própria do ds): CS:GO modo deathmatch + desativação de bomba
|
| 57 |
07-18 |
Guozhihe Summer |
Recriação de Punishing: Gray Raven com DeepSeek (suspeito da versão oficial)
|
| 58 |
07-18 |
stupid_scout |
Versão oficial do DeepseekV4: jogo estilo Battlefield totalmente reformulado, com bastante conteúdo novo (link de download nos comentários)
|
| 59 |
07-18 |
LikrFG |
Teste do modelo suspeito da versão oficial do deepseek v4
|
| 60 |
07-18 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Tem V8! Dois jogos no DS v4 oficial [Mario e corrida]; atualização rápida nº 4 — só jogando e compartilhando
|
| 61 |
07-18 |
Tianxing_tianxing |
Versão oficial do deepseek: mini-jogo feito por 4 yuans
|
| 62 |
07-18 |
Limeng aajjkk |
Versão oficial do DeepSeekv4pro: teste de 4.000 bolinhas geradas em uma frase, perfeito sem bug (modo max), com benchmark de desempenho.
|
| 63 |
07-17 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4: Delta Force e The Forest
|
| 64 |
07-17 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
DS v4 oficial em uma frase: [ferramenta de tradução de screenshot, jogo indie selecionado]; atualização rápida nº 3 — só jogando e compartilhando
|
| 65 |
07-17 |
Qilin1132 |
Quando você pede ao gray test oficial do deepseek v4 e à versão preview para fazer o mesmo jogo
|
| 66 |
07-17 |
Menghui 0 |
Versão oficial do deepseek v4: produzir jogo de corrida estilo kart
|
| 67 |
07-17 |
Fengwei Guangmao |
[Touhou Project] Comparação do DeepSeek suspeito em gray test vs preview: gera jogo bullet hell em uma frase
|
| 68 |
07-17 |
kdzzzds |
gray dsv4 — GTA em altíssima qualidade (sem assets externos, modelagem própria): 1 rodada + 1 rodada de correção de bug
|
| 69 |
07-17 |
Augenstern_-__- |
v4 gray test oficial — comparação de duas versões front-end
|
| 70 |
07-17 |
Meiyou Shezhi Yi |
deepseek open-sourceou o Claude Fable 5 ☝️
|
| 71 |
07-17 |
Xingguang yu Xue |
Versão oficial do DeepSeek v4 recria Kingdom: Two Crowns em vários turnos de diálogo
|
| 72 |
07-17 |
Hei Tao |
Animação da ópera Carmen feita à mão pela versão oficial do DeepseekV4
|
| 73 |
07-17 |
s Jiushi Zheyang s |
Suspeito gray test do DS V4 oficial: chorei de susto com o resultado; é a melhor versão que já vi da fusão Minecraft + No Man's Sky
|
| 74 |
07-17 |
kdzzzds |
Vem ver o enorme potencial escondido do front-end do v4 gray test (prompt gerado pela IA)
|
| 75 |
07-17 |
DaVinci-2nd |
Para quem ainda não pegou o gray test da versão oficial do dsV4 ou pegou e deu crash
|
| 76 |
07-17 |
kdzzzds |
Obra nuclear — suspeito gray test da versão oficial do dsv4: Minecraft / Outer Wilds, bloco de curvatura
|
| 77 |
07-17 |
e4glet |
DeepSeek 3D Walkman player
|
| 78 |
07-17 |
Maoyi cat |
[Vibecoding] Um solzinho tocável feito em conjunto por Claude e Deepseek
|
| 79 |
07-17 |
Yi Shuang Diantai |
Musk comenta sobre o Kimi k3! Só digo: deepseek NO1
|
| 80 |
07-17 |
Langji Tianya Ren free |
Gray test da versão oficial do deepseek fazendo Thunder Fighter
|
| 81 |
07-17 |
kdzzzds |
Quem ousa questionar o esteta do D-laoshi — suspeito gray dsv4 fazendo Minecraft só com imagens SVG
|
| 82 |
07-17 |
-Wenli- |
Gray test da versão oficial do deepseek v4: Minecraft + Spore, segunda revisão
|
| 83 |
07-17 |
Xingguang yu Xue |
Versão oficial do DeepSeek v4 gera Sky: Children of the Light em vários turnos de diálogo
|
| 84 |
07-17 |
kdzzzds |
Suspeito gray dsv4 — Meu Espaço Profundo: fortalecendo o prompt de arte sobre o prompt original para ver o efeito (sem acesso à web)
|
| 85 |
07-17 |
Aierkuide de Situ |
Gray test oficial do DeepSeek v4 + geração com Z-image: Gwent acadêmico
|
| 86 |
07-17 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
Teste nº 2! Avaliação profunda e completa do DeepSeek V4 oficial, com kimiK3 junto
|
| 87 |
07-17 |
Ye Zhi Ye Guiyi |
Teste do deepseek v4 oficial
|
| 88 |
07-17 |
Ye Zhi Ye Guiyi |
Teste do deepseek v4 oficial: gera jogo em uma frase
|
| 89 |
07-17 |
-Wenli- |
Suspeito gray test da versão oficial do dsv4: Minecraft + Spore
|
| 90 |
07-17 |
Dongmian no Songshu_ |
DeepSeek V4: World of Warcraft, remasterização em HD
|
| 91 |
07-17 |
Delight-linger |
Dois sóis no céu! Teste comparativo entre K3 e Deepseekv4 (gray test oficial)
|
| 92 |
07-16 |
kdzzzds |
Teste não rigoroso
|
| 93 |
07-16 |
PotnQ |
Gray test da versão oficial do DSV4: No Man's Sky com pouso pseudo sem costura
|
| 94 |
07-16 |
Tanguizhe Xiqian |
Versão oficial do Deepseekv4: jogabilidade de My Space Program, pouso suave na Lua
|
| 95 |
07-16 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4: gera World of Warcraft em vários turnos de diálogo
|
| 96 |
07-16 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Flappy Bird — comparação de efeitos preview vs oficial
|
| 97 |
07-16 |
stupid_scout |
Versão oficial do DeepseekV4: teste de Portal (a implementação ficou muito boa! Mais alguns testes de problemas de portal)
|
| 98 |
07-16 |
Hei Tao |
Versão oficial do DeepseekV4 gera Ace Attorney!
|
| 99 |
07-16 |
Luobida Shiyanshi |
O desempenho do Kimi K3 é absurdo! Vem aí outro "DeepSeek moment"? Inteligência Artificial
|
| 100 |
07-16 |
cacl2_lhg |
Suspeito mini-jogo estilo Mario Kart gerado pela versão oficial do Deepseek V4
|
| 101 |
07-16 |
Augenstern_-__- |
v4 gray test oficial: teste de animação de disparo de arco em SVG
|
| 102 |
07-16 |
stupid_scout |
Versão oficial do DeepseekV4: só pedi para remover comentários e ele de quebra corrigiu o bug do jogo
|
| 103 |
07-16 |
s Jiushi Zheyang s |
Suspeito fragmento de espaço de alta dimensão, gray test da versão oficial do Deepseek: gera Forza Horizon 6 em uma frase
|
| 104 |
07-16 |
Menghui 0 |
Versão oficial do deepseek v4 gera web game estilo Sekiro
|
| 105 |
07-16 |
stupid_scout |
Jogo estilo Battlefield gerado pela versão oficial do DeepseekV4 (o efeito é absurdo!!)
|
| 106 |
07-16 |
Ba Bixu Xu 112 |
[Mais recente em julho] De graça! DeepSeek V4 versão livre gratuita, sem limite de uso!
|
| 107 |
07-16 |
Sanshi Dingni |
dsv4 gera rhythm game de notas que caem com música personalizável
|
| 108 |
07-16 |
Delight-linger |
Explosão nuclear: dsv4 oficial gera vários jogos Android de uma só vez — parkour, RA, ação 2D, etc.
|
| 109 |
07-16 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Besiege: a simulação física é muito boa
|
| 110 |
07-16 |
Feiyue Maidanglao |
Gray test da versão oficial do deepseek v4: gera jogo de terror
|
| 111 |
07-16 |
Fan Gang Jiulong |
[Touhou] Deepseek-v4 versão oficial (suspeito) gray test gera de uma vez — Crônicas Mecânicas de Touhou
|
| 112 |
07-16 |
Augenstern_-__- |
dsv4 gray test oficial — corrige os dois primeiros episódios e mostra Mount & Blade
|
| 113 |
07-16 |
Augenstern_-__- |
Suspeito gray test da versão oficial do dsv4 — Backrooms
|
| 114 |
07-16 |
Augenstern_-__- |
Suspeito gray test da versão oficial do dsv4 — o jogo de terror japonês com mais atmosfera; comparação preview vs oficial
|
| 115 |
07-15 |
UPLUZ |
[Suspeito da versão oficial do DeepSeek] Mundo de Zelda
|
| 116 |
07-15 |
Delight-linger |
Versão oficial do Deepseekv4: Kerbal Space Program + Minecraft — pouso na Lua na prática (hard landing), 3 turnos de diálogo
|
| 117 |
07-15 |
Zuoshou Ajiu |
Jogo de sobrevivência gerado em uma frase pelo deepseekV4pro
|
| 118 |
07-15 |
Fan Gang Jiulong |
Suspeito gray test da versão oficial do dsv4 — Minecraft x No Man's Sky
|
| 119 |
07-15 |
Delight-linger |
Gray test da versão oficial do Deepseek: Raft + Minecraft (meu jogo de jangada)
|
| 120 |
07-15 |
Qitian Dasheng wy |
Deepseek, o que foi que esse Dafeiyu fez?
|
| 121 |
07-15 |
Tongshui test-2 |
Chocado com o deepseek
|
| 122 |
07-15 |
kdzzzds |
Suspeito gray test da versão oficial do deepseekv4 — Minecraft + No Man's Sky (áudio baixo)
|
| 123 |
07-14 |
kdzzzds |
(com crash) Suspeito gray test da versão oficial do dsv4 — Twilight Forest (parou no meio)
|
| 124 |
07-14 |
kdzzzds |
Suspeito gray test da versão oficial do deepseekv4 — The King of Fighters
|
| 125 |
07-14 |
kdzzzds |
Suspeito gray test da versão oficial do deepseek v4 — teste de terreno do Nether e do End no Minecraft (terreno gerado de uma vez)
|
| 126 |
07-14 |
kdzzzds |
Suspeito gray test da versão oficial do deepseekv4 — No Man's Sky
|
| 127 |
07-13 |
2258ppq |
Versão oficial do dsv4 — teste 2
|
| 128 |
07-11 |
Bukoyi Baohan Teshu Zifu |
Gray test da versão oficial do DeepSeek 4.0: desenvolvimento de mini-jogo
|
| 129 |
07-10 |
Feiyue Maidanglao |
Não sei se fui contemplado pelo gray test da versão oficial do deepseek v4; gerado com uma frase, mas o resultado é realmente bom
|
| 130 |
07-09 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4 gera Backrooms e jogo de terror em uma frase
|
| 131 |
07-09 |
Xiao Xiao Xiao Ming Bushi Xiaoming |
A joia nacional evolui de novo! Avaliação rápida do DeepSeek V4 oficial, com comparativo direto de Gemini 3.5 Pro / Grok 4.5 etc.
|
| 132 |
07-09 |
Delight-linger |
Gray test da versão oficial do dsv4? Terraria + Isaac + RTS + sistema operacional no navegador + Cut the Rope + Stardew Valley — todos testados
|
| 133 |
07-08 |
Dongmian no Songshu_ |
Gray test: versão oficial do DeepSeek V4 gera GTA5 em uma frase
|
| 134 |
07-07 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4 gera CS:GO em uma frase (registro de geração transparente)
|
| 135 |
07-07 |
Dongmian no Songshu_ |
Versão oficial do DeepSeek V4 gera Minecraft
|
| 136 |
07-06 |
System-Win-FUN |
Bug grave no Deepseek: ao responder perguntas há uma chance de ficar repetindo "recebido".
|
O que os 121 testes revelam
Os dados vêm do projeto open-source dsv4ga-news-gather, que indexa vídeos públicos do Bilibili mantendo título, criador, timestamp, descrição, comentários, sessões compartilhadas e links de download. O snapshot de 19 de julho mostra, em linhas gerais:
121vídeos de gray test
53criadores independentes
40sessões compartilhadas
12janela de dias (7/7–7/19)
Publicações por dia
Vazamentos esporádicos antes de 15 de julho, com explosão concentrada em seguida e pico em 18 de julho.
Top 10 criadores
Entre os dez primeiros, só kdzzzds e Delight-linger publicaram um volume grande de sessões. Verde = 5 ou mais sessões compartilhadas, laranja = 1–4, azul = nenhuma.
Xiao Xiao Xiao Ming
8· sem sessões
Dongmian no Songshu_
8· sem sessões
Delight-linger
7· 11 sessões
Augenstern_-__-
6· 1 sessão
Ye Zhi Ye Guiyi
4· sem sessões
stupid_scout
4· sem sessões
Xingguang yu Xue
3· sem sessões
O que as pessoas estão testando de fato
Classificação por título dos 136 registros. Jogos dominam de forma absoluta — backend de produção, segurança e projetos de longo ciclo quase não aparecem.
Outros jogos / protótipos
4332%
Cartas / RPG / arcade
1712%
Física / simulação espacial
129%
Corrida / mundo aberto
86%
Ferramenta / teste de motor
32%
Dois vieses importam mais do que qualquer número isolado. Viés de seleção: a maioria é "programação por desejo" — jogos no navegador, cenários 3D, animações em SVG, mini-brincadeiras com física, ferramentas musicais. Por isso, esse conjunto é uma evidência forte para prototipação rápida e geração de front-end, mas quase não diz nada sobre backend de produção, segurança, manutenção de monorepos grandes ou projetos com ciclos de vários meses. Viés de transparência: só 3 dos dez principais criadores compartilharam prompts ou logs de sessão. Dizer "versão oficial" no título é puro clickbait — os criadores em geral também só foram supostamente contemplados pelo gray test. Ao longo de todo o texto usamos a expressão versão suspeita do V4 em gray test.
No que o V4 parece ser bom
App de uma frase agora roda de verdade, não serve só para olhar
O padrão mais marcante é a geração de implementação completa a partir de uma especificação curta. No conjunto há mundos voxel, jogos de tiro, rhythm games, de sobrevivência, cenas em three.js, geradores de música e visualizações de engenharia. Um demo em SVG estilo GTA representativo foi, segundo a descrição, uma geração principal + uma rodada de correção de bug, e tem sessão compartilhada. Não é "uma frase entrega um jogo"; é "o modelo escolhe a arquitetura, costura subsistemas razoáveis para demonstrar a ideia e não regredir para um mockup oco".
Código 3D, SVG e simulações leves ficaram mais fortes
Cenas em three.js, assets SVG customizados, física de jogos e simulações interativas aparecem o tempo todo. Uma página web estilo CFD gás-líquido supostamente usa PBF para líquidos e LBM para gases, em duas rodadas de diálogo. O próprio criador aponta que a aerodinâmica não é realista e segue precisando de ajustes — exatamente a fronteira entre "protótipo impressionante" e "ferramenta de engenharia confiável".
O preço pode ser o verdadeiro headline
As comparações da comunidade descrevem o V4 e o Kimi K3 como próximos em projetos reais. Se a API final mantiver a vantagem histórica de preço da DeepSeek, "oferecer capacidade quase de fronteira pelo preço de infraestrutura" importa mais do que vencer qualquer demo head-to-head. Veja nossa comparação de preços de API de IA.
Onde o V4 ainda vacila
- Gosto e acabamento. Em composição de front-end e textos longos, a comunidade costuma preferir o Kimi K3. O visual do V4 pode ser impressionante, mas a qualidade varia muito conforme o design do prompt.
- Limites da instrução. Num demo, pediram ao modelo para remover comentários e ele, de quebra, corrigiu o bug do jogo. Esse tipo de iniciativa é mágico em brinquedos — e risco de revisão em repositório real. Cada diff precisa ser lido; não confunda "roda" com "aprovado".
- Confiabilidade em sessões longas de vários turnos. As sessões ainda quebram, saem dos trilhos ou acumulam dívida de arquitetura depois de vários turnos. Ser forte na primeira vez não garante ser forte na vigésima.
- Corretude física. Uma simulação de fluido ou de gravidade que parece certa não é um CFD ou mecânica válida. Visual certo ≠ valor numérico certo.
- Reprodutibilidade. O roteamento do gray test parece instável. Usuários diferentes podem ter atingido modelos, tiers ou comportamentos de sampling diferentes.
- Qualidade da evidência. Muitos vídeos não trazem prompt completo, identificação do modelo, número de falhas, uso de tokens nem edições manuais.
A descrição honesta é "gerador de protótipos com teto alto e capacidade real de programação" — não "engenheiro sênior que dispensa revisão".
V4 vs Kimi K3 vs GPT-5.6 vs Fable 5.0
Não existe aqui um benchmark controlado de quatro modelos. A tabela abaixo é uma síntese orientada a fluxo de trabalho, baseada em evidências do gray test e em feedback de usuários — não é um ranking.
| Modelo | Possíveis vantagens | Posição do V4 | Melhor papel |
| DeepSeek V4 | custo, implementação ampla, protótipo rápido | linha de base | código padrão do dia a dia e primeira implementação |
| Kimi K3 | acabamento de front-end, apresentação, texto | V4 um degrau abaixo no acabamento, mas equivalente em funcionalidade na maioria dos casos | otimização de UI, texto de produto, refinamento visual |
| GPT-5.6 | consistência de revisão, ecossistema de ferramentas, raciocínio entre arquivos | no trabalho de rotina o V4 é a alternativa mais barata; não há evidência suficiente de vitória geral | code review, validação, bugs teimosos |
| Fable 5.0 | implementação de ciclo longo, recuperação em vários turnos | em demos selecionadas o V4 parece próximo, mas tem estabilidade de borda menor | modelo de upgrade para a parte mais difícil |
V4 vs Kimi K3: o material direto mais confiável aponta para um embate equilibrado. Em front-end e texto o K3 parece melhor; o V4 tem custo-benefício superior e é competitivo na implementação. Um vídeo de comparação chegou a dezenas de milhares de views, mas prompt e pontuação não foram padronizados.
V4 vs GPT-5.6: comentários isolados afirmam que em alguns projetos web um ganha do outro. Isso é inspiração para teste, não resultado de benchmark. A pergunta útil de verdade é: o V4 consegue rodar a suíte de testes do seu repositório a um custo menor?
V4 vs Fable 5.0: demos de jogos impressionantes tornam a comparação tentadora, mas esse conjunto não basta para sustentar que o V4 empata em código grande, auditoria de segurança ou execução autônoma por longo tempo. Até que testes reprodutíveis mostrem o contrário, trate o Fable 5.0 como opção de upgrade.
Recomendação prática
A configuração mais barata e que não te queima:
- Deixe o V4 fazer os primeiros 80–90%. Planejamento, scaffold, implementação, testes, documentação, correção de bug de rotina.
- Valide localmente. Lint, checagem de tipos, testes unitários e de integração, mais revisão humana de diff. Inegociável.
- Suba com evidência. Quando travar, mande o diff, os testes que falharam e o problema específico para o Kimi K3, GPT-5.6 ou Fable 5.0 — não reenvie o mesmo prompt vago.
- Mantenha uma assinatura leve de modelo premium, não várias integrais. Use-a como revisor e modelo de resgate, não como consumidor padrão de tokens.
Recomendado: V4 como modelo de implementação de alto throughput, somado a uma assinatura leve premium para code review independente e para problemas que vários turnos não resolveram.
Essa configuração só funciona quando o segundo modelo recebe evidência (diff, logs, testes falhando). Perguntar o mesmo prompt vago a dois modelos em geral só dobra o custo, sem ganhar confiabilidade.
O que validar no lançamento oficial
A versão oficial precisa ser julgada por reprodutibilidade, não por demo de lançamento. Verifique:
- o ID exato do modelo na API, e se web, app e API usam o mesmo tier;
- janela de contexto, limite de saída, suporte a chamada de ferramentas e saída estruturada;
- preço por token de entrada, de entrada em cache e de saída;
- rate limit, roteamento em pico, e se os tiers "Pro/Flash/Max" se comportam de forma diferente;
- edição em nível de repositório, conclusão de testes e aderência a instruções;
- probabilidade de reproduzir a qualidade do gray test com o mesmo prompt;
- licenciamento, retenção de dados e opções de implantação.
Assim que a DeepSeek publicar o model card oficial, a documentação da API e o preço, atualizamos este texto. Até lá, qualquer afirmação sobre o modelo final é provisória.
Perguntas frequentes
A versão oficial já está disponível?
Este conjunto de dados registra roteamento suspeito de gray test, não um lançamento confirmado. Dizer "versão oficial" no título do vídeo não equivale a confirmação oficial da DeepSeek.
Como é, afinal, a capacidade de programação do V4?
A evidência é mais forte em protótipos web rápidos, jogos, SVG, three.js e correção iterativa de bugs; é mais fraca em monorepos de produção grandes, código sensível a segurança e tarefas automáticas de longa duração.
O V4 é mais forte que o Kimi K3?
Não em todas as tarefas. O V4 parece próximo e pode ter custo-benefício melhor; o Kimi K3 costuma levar no acabamento de front-end e em texto. Decida rodando com o mesmo prompt, mesmo runtime e mesmos critérios de aceitação.
Devo cancelar minha assinatura premium de código?
Para muita gente, reduzir a uma assinatura leve premium faz mais sentido do que cancelar tudo. Deixe o V4 carregar o volume e mantenha um modelo independente para revisão e upgrade.
Onde ver o gray test original?
Comece pelo índice no GitHub com os 121 vídeos. Casos representativos: teste em largura do V4 vs Kimi K3, comparativo de física 3D, teste de Minecraft com 8.192 chunks, caso de correção espontânea de bug.