1. Panorama da Transmissão: Uma Cadeia de Três Níveis de Preços do Segmento de Ponta ao Intermediário
O caminho de transmissão da demanda no atual mercado de locação de capacidade computacional revelou claramente três etapas:
Primeiro nível (B300 → H200): O preço elevado e sem referência do B300, aliado a informações opacas sobre transações, faz com que a demanda de ponta transborde para o H200, elevando persistentemente os preços de locação deste último.
Segundo nível (H200 → Pro 6000): A oferta insuficiente de H200, com prazos de locação travados em no mínimo três anos, leva investidores de capital em projetos de capacidade computacional a voltarem seus olhos para GPUs de estação de trabalho, como a Pro 6000 e Pro 6000D.
Terceiro nível (Pro 6000D → 4090/5090): O mercado intermediário abaixo da Pro 6000 enfrenta pressão dupla de oferta, com as 4090 existentes e as novas 5090 incrementais, resultando em aumentos de preço limitados e transmissão bloqueada.
Análise SMM:A força motriz central desta cadeia de transmissão não é uma mudança equivalente na demanda, mas sim o fato de a escassa oferta de ponta forçar a demanda a "buscar substitutos" em cada nível — cada etapa de transmissão é acompanhada por concessões de desempenho e preço, e a eficiência da transmissão depende da elasticidade da oferta do nível seguinte.
2. Transmissão de Primeiro Nível: Vácuo de Preço do B300, H200 Torna-se Novo Referencial para Demanda de Ponta
As cotações dos servidores Nvidia B300 permaneceram elevadas, mas o mercado consistentemente careceu de um preço de referência verificável. A discussão sobre o B300 continua intensa em toda a cadeia industrial, mas as fontes publicamente disponíveis sobre informações reais de transação são extremamente limitadas. Um intenso cabo de guerra entre compradores e vendedores deixou o mercado em certo grau de caos. Este estado de estar "precificado, mas não negociado" ou "preço elevado sem referência" é o impulsionador direto do transbordamento da demanda para o H200.
Como o ápice de desempenho da arquitetura Hopper, o H200 rapidamente entrou na mira de locadores de capacidade computacional e partes demandantes:
Compras de máquinas completas: As cotações no mercado à vista para compras de máquinas completas H200 HGX atingiram aproximadamente 5 milhões de yuans/unidade no início de agosto de 2026. Por meio de coleta de dados, a SMM entende que os preços reais de transação para compras à vista de servidores H200 HGX estão em torno de 4,6 milhões de yuans/unidade. Em 30 de julho, as cotações para versões PCIe à vista do H200 estavam na faixa de 3,45 a 3,5 milhões de yuans. No mercado de Hong Kong, a cotação por placa da H200 PCIe é de cerca de US$ 43 mil.
Preços de locação continuam subindo: Em 3 de agosto, os preços de locação do H200 na região de Guizhou atingiram 120 mil yuans/unidade/mês; até 10 de agosto, as cotações para locações de H200 com configuração similar (não conectada em rede) na região de Sichuan subiram ainda mais, para 130 mil yuans/unidade/mês.
Suboferta: No final de julho, uma grande empresa de locação de servidores em Hangzhou declarou que todos os seus servidores H200 haviam sido totalmente locados recentemente, com a oferta aquém da demanda, e nenhum recurso estaria disponível até o próximo ano, no mínimo.

Um cálculo retroativo aproximado baseado em um ciclo de retorno de três anos de locação: 130 mil yuans/unidade/mês × 36 meses = 4,68 milhões de yuans, o que é amplamente consistente com o preço real de compra de 4,6 milhões de yuans mencionado anteriormente, confirmando indiretamente que o nível atual de preço de locação não é artificialmente elevado, mas um reflexo da genuína relação de oferta e demanda.
Em meados de julho de 2026, um rumor não confirmado circulou entre intermediários de locação de servidores: aproximadamente 10 mil servidores H200 estavam aguardando liberação alfandegária em Hong Kong. O mercado esperava temporariamente que a entrada desses H200 reduziria drasticamente os preços domésticos de locação de capacidade computacional e os preços de compra do B300. No entanto, os preços de locação do H200 subiram em vez de cair, indicando indiretamente que o progresso da entrada desses H200 não foi tranquilo até o momento.
Visão SMM:O aumento persistente nos preços de locação do H200 reflete a realidade estrutural do mercado de capacidade computacional de ponta sob duas dimensões — pelo lado da demanda, as necessidades de capacidade computacional para treinamento e inferência de IA ainda estão se acelerando; pelo lado da oferta, o B300 luta para formar uma oferta eficaz e a entrada do H200 no mercado é dificultada, significando que a oferta efetiva de capacidade computacional de ponta está longe de ser suficiente para igualar o crescimento da demanda. A transmissão B300 → H200 é um "transbordamento forçado", não uma escolha ativa.
3. Transmissão de Segundo Nível: Suboferta do H200 Traz Pro 6000 à Mira do Capital
Com os preços do H200 mantendo-se altos e a oferta escassa, investidores de capital em projetos de capacidade computacional começaram a voltar sua atenção para GPUs de estação de trabalho Pro 6000 e Pro 6000D. Atualmente, o preço cotado para a GPU versão servidor Pro 6000 é de cerca de 130 mil yuans/unidade, e o aluguel mensal da Pro 6000 na região do Delta do Rio Yangtzé é de cerca de 32 mil yuans.
Comparado ao preço de locação do H200 de 130 mil yuans/unidade/mês em Sichuan, a barreira de entrada da Pro 6000 é significativamente menor (cerca de um quarto do aluguel mensal do H200), oferecendo um certo apelo para projetos com orçamentos apertados ou requisitos menos rigorosos quanto ao poder computacional extremo.
Visão SMM:A lógica de transmissão H200 → Pro 6000 difere da B300 → H200: a primeira é "recorrer ao H200 porque o B300 é inacessível", enquanto a última é "visar a Pro 6000 porque o H200 está indisponível para locação" — uma é impulsionada por preço, a outra por disponibilidade. A Pro 6000 ainda está no estágio de atrair a atenção do capital, sem um mercado de locação em larga escala ainda formado; a transmissão ainda está em seus estágios iniciais.
4. Transmissão de Terceiro Nível Bloqueada: Oferta Ampla de 4090/5090 Limita Margem de Alta para Preços Intermediários
A transmissão de preços da capacidade computacional de gama média-alta (Pro 6000) para a gama média (4090/5090) enfrenta uma dificuldade significativamente maior. Abaixo do nível Pro 6000, o mercado enfrenta pressão dupla de oferta dos servidores existentes de oito placas 4090 e dos novos servidores incrementais de oito placas 5090, suprimindo notavelmente os aumentos de preço.
Especificamente,4090: Na semana passada, dois recursos discretos de 4090 na região do Delta do Rio Yangtzé foram locados por 6.900 yuans/mês, muito abaixo da menor cotação de mercado de 7.300 yuans, indicando que os recursos existentes exibem considerável elasticidade de preço quando vendidos em quantidades fragmentadas, e os locadores têm fraco poder de barganha.
5090: O preço de locação para a versão de servidor com memória de 512 GB da 5090 no Delta do Rio das Pérolas é de cerca de 13 mil yuans/mês, um aumento de aproximadamente 13% em relação aos cerca de 11.500 yuans/mês na mesma região no início de julho de 2026, muito inferior ao aumento de preço do H200 no mesmo período. A oferta incremental de 5090 (novos servidores de oito placas entrando continuamente no mercado) compensa efetivamente a pressão de demanda transmitida do upstream.
Visão SMM:A causa raiz do bloqueio da transmissão de terceiro nível reside na elasticidade da oferta — o mercado de estoque existente de 4090 é fragmentado, com recursos discretos aparecendo frequentemente e deprimindo o preço médio; a oferta incremental de 5090 continua a se expandir e ainda não formou uma situação de suboferta. O mercado de capacidade computacional de gama média tende mais para um "mercado comprador", em forte contraste com o "mercado vendedor" do H200. Quando a demanda se transmite da ponta alta para a intermediária, o que encontra não é uma barreira de preço, mas um "amortecedor" de oferta ampla — a força de transmissão é grandemente enfraquecida aqui.
5. Razão Mais Profunda para a Declinante Eficiência de Transmissão: Elasticidade da Oferta Amplificada em Cada Nível
A eficiência decrescente da cadeia de transmissão de três níveis não é acidental; é um reflexo sistemático das diferenças na elasticidade da oferta entre as camadas:

Análise SMM:A oferta de capacidade computacional de ponta (B300/H200) está travada em um estado rígido por controles de exportação, de modo que o aumento da demanda só pode ser resolvido via aumentos de preço; por contraste, a elasticidade da oferta de capacidade computacional de gama média (4090/5090) é muito maior que a de ponta, e nova capacidade pode responder rapidamente às mudanças na demanda, suavizando assim os sinais de preço. É por isso que, na mesma cadeia de transmissão de demanda, os preços upstream podem subir enquanto os downstream não — não é demanda insuficiente, mas diferentes "capacidades de absorção" do lado da oferta.
6. Conclusão e Perspectivas: Onde Está o Limite da Transmissão de Demanda
A SMM acredita:A atual transmissão da demanda de locação de capacidade computacional do B300 para o H200 foi totalmente estabelecida, com o aumento persistente nos preços de locação do H200 como evidência direta; a transmissão do H200 para a Pro 6000 está em andamento, mas ainda em seus estágios iniciais, dependendo de quanto tempo a rigidez na oferta do H200 persistir; a transmissão adicional da gama média-alta para a gama média (4090/5090) é restringida pela oferta ampla, tornando difícil formar uma ligação de preços eficaz no curto prazo.
Perspectivas Futuras:
Curto prazo (3–6 meses): A situação de oferta restrita para o H200 permanecerá inalterada, com preços de locação em regiões como Sichuan e Guizhou mantendo-se altos; se o progresso de substituição das GPUs domésticas de ponta e dos ecossistemas de desenvolvimento for lento, a posição do H200 como principal modelo de capacidade computacional de ponta se solidificará ainda mais. O mercado de locação da Pro 6000 gradualmente tomará forma, mas seu potencial de alta será limitado pela oferta de 4090/5090.
Médio prazo (6–12 meses): Se a entrada do H200 no mercado progredir, os preços de locação de ponta poderão sofrer um recuo, mas a extensão será limitada — a demanda reprimida acumulada ao longo de três anos servirá como suporte de preço. Caso a Pro 6000 forme um mercado de locação considerável durante este período, tornar-se-á um referencial de precificação chave ligando a ponta alta à gama intermediária.
Longo prazo (mais de 1 ano): As variáveis centrais residem em saber se GPUs domésticas de ponta e ecossistemas de desenvolvimento podem preencher a lacuna de oferta no mercado chinês de capacidade computacional de ponta, e se a série Blackwell pode formar uma oferta eficaz para a China. Se a capacidade computacional doméstica de ponta continuar ausente, todo o sistema de preços de locação de capacidade computacional se solidificará em uma "escada de preços de três níveis", com o H200 no topo, a Pro 6000 no meio e a 4090/5090 na base; a eficiência da transmissão entre os níveis será determinada por suas respectivas elasticidades de oferta, em vez de ser impulsionada uniformemente pela demanda. Até lá, o mercado de locação de capacidade computacional não será mais uma "cadeia de transmissão", mas um "pool de precificação em camadas" — cada camada com sua própria lógica de oferta e demanda, e as correlações de preços entre as camadas tenderão a enfraquecer.
![[SMM Computing Power Express] Dois nós A100 80G com rede IB para alugar no sul da China, a 35.000 yuans por mês com locação mínima de um ano.](https://imgqn.smm.cn/usercenter/JYbQQ20251217171736.jpg)
![[Revisão do Meio-dia do Poder de Computação SMM] Preços baixos do H100 no Ocidente se recuperam, carga à vista reina enquanto recursos recém-lançados sobem](https://imgqn.smm.cn/usercenter/tSwaX20251217171735.jpg)
![[SMM Computing Power Flash] Cotações de GPU de um grande provedor de nuvem não apresentaram flutuações por 11 dias, A100/A10 esgotados em toda a linha](https://imgqn.smm.cn/usercenter/nQsOk20251217171736.jpg)
