A DeepSeek tirou o V4-Flash do preview e o transformou em uma API oficial da versão final na manhã de sexta-feira, no horário de Pequim. O ponto interessante não é o lançamento — é que a tabela de benchmarks da própria empresa coloca seu modelo barato acima do modelo caro, e o modelo caro ainda nem foi lançado.

As pontuações e os preços

Do changelog da DeepSeek: Terminal Bench 2.1 82.7, Cybergym 76.7, Toolathlon verified 70.3, DSBench-FullStack 68.7, DeepSWE 54.4, NL2Repo 54.2. Janela de contexto 1M, saída máxima 384K, modo de raciocínio comutável. Preços por milhão de tokens: Flash $0.14 in / $0.28 out contra Pro a $0.435 / $0.87. Os limites de concorrência são 2.500 para o Flash e 500 para o Pro. Uma sobretaxa no horário de pico, dobrando as tarifas durante o horário comercial de Pequim, é indicada como iminente.

Três coisas que a cobertura está interpretando errado

Primeiro, "official version" não é um novo modelo. O changelog da DeepSeek afirma que o V4-Flash-0731 "mantém a mesma arquitetura e o mesmo tamanho do modelo" do preview e que "foi apenas re-treinado posteriormente". Arquitetura e contagem de parâmetros permanecem inalteradas — trata-se de uma atualização pós-treinamento sendo apresentada como lançamento. Segundo, é somente API. Nenhum peso foi liberado, e apenas a interface do V4-Flash foi atualizada; o app, os modelos da web e a API do V4-Pro não foram alterados. Quem ler isso como uma liberação de pesos abertos estará errado. Terceiro, a tabela de benchmarks é da própria DeepSeek, e o conjunto de comparação é favorável por construção: ele é pontuado contra o próprio V4-Pro-Preview da DeepSeek — um preview, não um produto lançado — e contra o GLM-5.2 da Zhipu. Nenhum modelo ocidental de fronteira aparece nela.

Por que a inversão na hierarquia importa

Uma camada barata superando a camada cara em tarefas de agentes, por cerca de um terço do preço, é um sinal vivo de que os ganhos atuais em trabalho agêntico estão vindo do pós-treinamento, e não da escala. Isso também deixa o V4-Pro em uma posição embaraçosa: ainda em preview e agora batido por seu irmão menor nos números da própria desenvolvedora.

Um número que não deve ser publicado

Veículos chineses estão citando 284 bilhões de parâmetros totais e 13 bilhões de parâmetros ativos. Isso não aparece em nenhuma página da DeepSeek que pudemos verificar e não deve ser repetido como fato.