I. Visão Geral do Evento
Em 24 de abril de 2026, a DeepSeek lançou oficialmente a versão prévia dos grandes modelos da série V4, incluindo o principal DeepSeek-V4-Pro (1,6 trilhão de parâmetros totais / 49 bilhões de parâmetros ativados) e o leve DeepSeek-V4-Flash (284 bilhões de parâmetros totais / 13 bilhões de parâmetros ativados). Ambos suportam nativamente uma janela de contexto de 1 milhão de tokens e são totalmente abertos sob a licença MIT. A série V4 entrou em disponibilidade oficial em 20 de julho, e a API da versão oficial V4-Flash-0731 foi lançada para testes públicos em 31 de julho.

No mesmo dia, a DeepSeek anunciou uma redução permanente de 75% no preço da API do V4-Pro. Em cenários de acerto de cache, o preço de entrada caiu para apenas 0,025 yuan por milhão de tokens, com saída a 6 yuan por milhão de tokens — um novo preço mínimo entre os modelos de ponta globais.
II. Avanços Tecnológicos: Não Se Trata Apenas de Ser Barato
A série V4 introduziu três tecnologias principais:
- Arquitetura de Atenção Híbrida (CSA + HCA) : Combina atenção esparsa comprimida com atenção fortemente comprimida. Sob um contexto de 1 milhão de tokens, a computação de inferência é apenas 27% da V3.2, e o cache KV utiliza apenas 10%.
- Hiperconexão com Restrição de Variedade (mHC) : Substitui as conexões residuais tradicionais, garantindo estabilidade de treinamento para redes com dezenas de milhares de camadas.
- Treinamento e Inferência com Precisão Mista FP4/FP8 : Primeira implementação na indústria. Reduz pela metade a pressão na largura de banda da VRAM e duplica a eficiência da inferência.
No SWE-bench Verified (capacidade de programação), o V4-Pro obteve 80,6%, liderando todos os modelos de código aberto e quase igualando os 80,8% do Claude Opus 4.6. Obteve 87,5% no MMLU-Pro e 85,0% no raciocínio matemático AIME 2025. Em seu relatório técnico, a DeepSeek admitiu estar “ligeiramente atrás do GPT-5.4 e do Gemini-3.1-Pro por cerca de 3 a 6 meses”, mas considerando a diferença de preço, isso é quase irrelevante.
III. Massacre nos Preços: A “Linha de Execução” para Modelos Globais
A precificação do V4-Pro quebrou diretamente o sistema de preços dos grandes modelos globais. Abaixo está uma comparação dos preços de saída para os principais modelos em julho de 2026 (em dólares americanos por milhão de tokens):
Gráfico 1: Comparação dos Preços de Saída da API dos Principais Modelos em Julho de 2026 (Escala Logarítmica)

A comunidade de desenvolvedores fora da China chegou a um consenso: Para a grande maioria dos cenários de consumo final (C-end) e de negócios de pequeno e médio porte (B-end), incorrer em dezenas de vezes o custo de inferência para ganhos marginais de desempenho não tem viabilidade comercial. Para qualquer concorrente com preço superior ao da DeepSeek, restam apenas dois caminhos: cortar proativamente os preços de forma significativa ou abandonar completamente o mercado de desenvolvedores de massa.
Gráfico 2: Comparação dos Principais Indicadores de Referência (Gráfico Radar)

IV. Impacto nos Principais Modelos
4.1 OpenAI: Da Arrogância aos Cortes Urgentes de Preços
A OpenAI foi a mais diretamente atingida. Em 2025, sua receita anual foi de US$ 13 bilhões, o gasto total de US$ 34 bilhões e o prejuízo líquido de US$ 39 bilhões, sendo cerca de US$ 8 bilhões de perdas operacionais.
Em 30 de julho de 2026, apenas três semanas após o lançamento do GPT-5.6, a OpenAI anunciou urgentemente um corte de 80% no preço da versão Luna. O CEO Sam Altman reconheceu publicamente que o custo é o "maior desafio do setor" e afirmou que a "OpenAI tem o prazer de reduzir os preços em 75%", o que foi interpretado por observadores como uma resposta passiva à DeepSeek.
Na plataforma OpenRouter, o consumo semanal de tokens por modelos chineses já ultrapassou 60%, enquanto o dos modelos dos EUA caiu para menos de 20% [9]. Dados da plataforma de nuvem americana Vercel mostram que a participação de uso dos modelos DeepSeek no mercado empresarial saltou de 1% em abril para 17% em maio.
4.2 Anthropic: Estratégia de Preços Altos Sob Pressão
O Claude Fable 5 tem preço de US$ 50 por milhão de tokens de saída, 57 vezes o do V4-Pro. Em junho de 2026, a Anthropic começou a proibir usuários fora da China de usar o Claude, encolhendo proativamente seu mercado — interpretado como um movimento forçado pelos custos excessivamente altos de computação para se concentrar em mercados de alta ARPU (receita média por usuário).
4.3 Google: Escassez de Poder de Computação
Os pedidos acumulados do Google Cloud atingiram US$ 460 bilhões, e o Gemini começou a implementar cotas de uso para grandes clientes como a Meta.
4.4 Microsoft: Sinais de Abandono
Em 16 de junho de 2026, a Microsoft começou oficialmente a avaliar a integração do DeepSeek V4 ao Copilot Cowork para substituir os modelos da OpenAI e da Anthropic. O CEO Satya Nadella declarou publicamente: "Modelos mais baratos e escolhas mais amplas aumentarão a confiança da sociedade na IA; o público não tolerará que poucos modelos e empresas monopolizem todo o aprendizado." Dada a participação acionária de 27% da Microsoft na OpenAI, essa declaração abalou o setor.
4.5 Nvidia: Rachadura no Fosso do CUDA
No dia do lançamento do DeepSeek V4, foi alcançada a adaptação completa em oito grandes fabricantes chineses de GPU: Huawei Ascend, Cambricon, Hygon, Moore Threads, Muxi, Kunlun Core, Alibaba T-Head e Tianjic. A Bernstein prevê que a participação da Nvidia no mercado de aceleradores de IA na China cairá de 95% para cerca de 8% em 2026, enquanto a da Huawei Ascend subirá para 50%–62%.
Gráfico 3: Linha do Tempo dos Principais Eventos da Guerra de Preços dos Grandes Modelos em 2026

V. Frenesi de Capital: Avaliação de 500 Bilhões
Em junho de 2026: concluiu a primeira rodada de financiamento externo superior a 50 bilhões de yuans, com uma avaliação superior a US$ 50 bilhões. Os investidores incluíram Liang Wenfeng contribuindo pessoalmente com 20 bilhões de yuans, Tencent com 10 bilhões de yuans, CATL com 5 bilhões de yuans, JD.com com 3 bilhões de yuans e o Fundo Nacional de Investimento na Indústria de IA.
Agosto de 2026: Lançou uma segunda rodada de financiamento de 50 bilhões de yuans, com avaliação pré-investimento de cerca de 500 bilhões de yuans (aproximadamente US$ 74 bilhões).
A avaliação total dos quatro principais laboratórios puros de IA da China atingiu cerca de US$ 159 bilhões, partindo de quase zero há 18 meses.
VI. Dados de Mercado: Modelos Chineses Dominam os Rankings Globais de Uso
Gráfico 4: Participação Global de Chamadas de Tokens na Plataforma OpenRouter (27 de Julho a 2 de Agosto)

VII. Reviravoltas e Preocupações
7.1 Crise de Poder de Computação, Preços Prestes a Aumentar
Em 6 de agosto, a DeepSeek anunciou que estava prestes a "elevar significativamente os preços da API". Seu poder de computação atual equivale a apenas cerca de 20.000 GPUs H100, muito atrás de concorrentes americanos como a OpenAI.
7.2 Riscos Políticos
O governo dos EUA está extremamente vigilante quanto à entrada dos modelos da DeepSeek na infraestrutura empresarial americana. Mesmo quando implantados nos data centers da Microsoft Azure nos EUA, ainda enfrentam análises de segurança.
7.3 Paradoxo da Comercialização
A relação preço/vendas (P/S) do V4-Pro ultrapassou 3.800 vezes, dezenas de vezes a da Anthropic, mas sua receita anualizada é extremamente baixa. A lógica de precificação de Liang Wenfeng era de que "recuperar o custo do servidor em 10 meses é considerado lucro razoável", e os investidores enfrentam o risco de inversão de avaliação.
VIII. Comentário da SMM
A SMM comentou sobre isso. Em primeiro lugar,o referencial global de precificação de grandes modelos mudou de um entendimento tácito entre os três oligarcas do Vale do Silício para a "linha de morte" definida pela DeepSeek. Enquanto isso, a rota de eficiência extrema do MoE + atenção esparsa + precisão mista demonstra que o desempenho de ponta não precisa depender do empilhamento de poder de computação. Do lado do ecossistema, chips nacionais como o Huawei Ascend conquistaram oportunidades práticas em grande escala, e a barreira do CUDA está sendo abalada,O fim da competição global de grandes modelos pode não ser vencido pelo modelo mais forte, nem pelo mais barato, mas pela solução ótima na curva de custo-benefício "capacidade/custo", que será o vencedor final.
Referências
- DeepSeek V4 Pro Chega com Contexto de 1 Milhão de Tokens, Redefinindo Nosso Cálculo de Custos — —
- AI Wiki —
- DeepSeek se Torna a Linha de Morte Global da IA —
- DeepSeek-V4-Pro: O Modelo de Código Aberto que Está Reescrevendo as Regras da IA —
- DeepSeek e Zhipu Rompem o Bloqueio do Poder de Computação: Modelo Zhipu Entra no Top Três, DeepSeek Reduz o Custo para 1/20 —
- Como a DeepSeek e o Alibaba Estão Derrubando as Barreiras de Preço da IA: Uma Diferença de Custo de 70 Vezes Está Redesenhando o Panorama da Indústria Global —
- Após o Lançamento Oficial do DeepSeek-V4-Flash, Líderes como a OpenAI Cortaram Preços —
- Guerra de Preços da Inferência de IA Explicada —
- Custo de Inferência da DeepSeek Cai para 1/36 do GPT-4o: Como Isso Irá Reescrever as Regras do Setor? —
- A Infraestrutura de IA se Tornou o Tipo de Negócio que Munger Mais Odeia —
- Microsoft Avalia Usar o Modelo DeepSeek V4 para Cortar Custos e Aumentar a Eficiência, Possivelmente Substituindo OpenAI e Anthropic —
- Guerra de Preços da IA 2026: Por Que o Verdadeiro Vencedor Não é a DeepSeek Nem a OpenAI —
- Google raciona Gemini para a Meta: quando a computação se torna o recurso mais raro —
- Microsoft de Olho no DeepSeek V4 para o Copilot Cowork: O que a Hospedagem no Azure Não Pode Resolver —
- Boom dos Chips Nacionais: O que a Nvidia Mais Teme Chegou —
- A Grande Migração do Poder de Computação da IA: 2026, Três Mudanças Simultâneas —
- DeepSeek Capta US$ 7,4 Bilhões com Avaliação de US$ 50 Bilhões na Primeira Rodada de Financiamento Externo —
- Informações: DeepSeek Reiniciou uma Segunda Rodada de Financiamento de 50 Bilhões de Yuans —
- Avaliação Chega a 500 Bilhões de Yuans, DeepSeek Lidera Rankings Globais de Chamadas de Grandes Modelos —
- Acabou a Baixa de Preços! DeepSeek Deve Aumentar os Preços Significativamente — \
- Quais São as Perspectivas de Desenvolvimento Futuro da DeepSeek? —
![[SMM Revisão do Meio-dia de Poder Computacional] O menor preço da 4090 no Delta do Yangtzé sobe, e o poder de barganha pelo poder computacional de inferência no leste da China muda para o lado da oferta.](https://imgqn.smm.cn/usercenter/ipCjz20251217171734.jpeg)
![[SMM Computing Power Express] Um determinado provedor de serviços de nuvem de computação inteligente está cotando aluguel mensal de 7.200 yuan/unidade/mês para servidores 4090 de oito placas, valor superior à cotação baixa anterior.](https://imgqn.smm.cn/usercenter/SSKOK20251217171734.jpeg)
![O boom na demanda por poder computacional de IA impulsiona a alta contínua nas operações de folhas de cobre; conectores de alta velocidade para cabos de cobre se fortalecem, Taichenguang lidera os ganhos [SMM Express]](https://imgqn.smm.cn/usercenter/tXxfd20251217171713.jpg)
