1. Fenómeno: Dentro de la misma cadena industrial de alquiler de potencia de cálculo, las condiciones de los contratos de arrendamiento para servidores GPU nacionales y servidores GPU Nvidia
muestran una clara divergencia entre el alquiler de potencia de cálculo nacional y el de Nvidia. Los servidores nacionales se pueden alquilar por año, mientras que los servidores Nvidia generalmente requieren contratos fijos de mínimo tres años.
Las tarjetas nacionales se encuentran en un “mercado de compradores” : la Ascend 910B2 presenta altas tasas de vacancia y cotizaciones más bajas en algunas regiones. Operadores y arrendadores ofrecen contratos cortos de un año a cambio de liquidez, reflejando precios típicos de sobreoferta.
Las tarjetas importadas están en un “mercado de vendedores” : para las H100/H200, no solo el plazo mínimo de arrendamiento es fijo, sino que un contrato fijo de cinco años cuesta solo entre 3.000 y 5.000 yuanes al mes menos que el de tres años (según fuentes de SMM); si un comprador firma un contrato de cinco años para ahorrar costes, el descuento no alcanza para cubrir el riesgo del período de bloqueo adicional de dos años. El hecho de que los compradores estén dispuestos a aceptarlo muestra que la demanda principal es “asegurar el acceso a tarjetas en los próximos cinco años”, más que el precio .
SMM Análisis: Las cláusulas de plazo contractual se han convertido en una herramienta para que la oferta “filtre clientes por duración del contrato”: las tarjetas nacionales usan contratos cortos para atraer clientes, las tarjetas Nvidia fidelizan clientes con contratos largos.
2. Lado de la oferta: las sanciones al embargo de GPU Nvidia bloquean la oferta
A continuación, un cronograma de los controles del Departamento de Comercio de EE. UU. sobre las exportaciones de chips de alta gama como Nvidia H100 y B300 a China:

SMM Perspectiva: De H100, H800 a H200, el suministro de tarjetas de alta gama a China en los últimos cuatro años ha estado en un ciclo de “control—endurecimiento—despacho limitado”; la “revisión caso por caso” para las H200 también implica que cada entrega está plagada de incertidumbre. Para los arrendatarios, si no aseguran recursos hoy, quizás no puedan adquirirlos mañana : esta es la lógica de oferta más fundamental detrás de los contratos fijos de 3/5 años.
3. Lado de la demanda: la potencia de cálculo inteligente entra en un período de crecimiento explosivo, y la brecha entre oferta y demanda se amplía
La explosión de la demanda de cálculo inteligente ha convertido el “aseguramiento de recursos” de una opción a una necesidad en el alquiler de potencia de cálculo:
La capacidad total de cálculo inteligente aumentó sustancialmente : Según datos divulgados por el MIIT el 20 de julio de 2026, a finales de junio de 2026, la capacidad de cálculo inteligente de China alcanzó 2.185 EFLOPS (FP16) , un incremento de aproximadamente 37 % respecto a los aproximadamente 1.590 EFLOPS de finales de 2025. De esta cifra, la región occidental representó el 32,6 %, y la tasa de utilización de las instalaciones informáticas nacionales fue del 71,4 %.
La brecha se amplía : Según datos de CAICT, en el primer trimestre de 2026, la demanda de cálculo de IA en China se disparó un 417 % interanual , mientras que el crecimiento de la oferta fue solo de alrededor del 128 % : el crecimiento de la demanda fue aproximadamente 3,3 veces el de la oferta.
Brecha estructural : Según estimaciones públicas del sector, la oferta efectiva de potencia de cálculo de alta gama necesaria para el entrenamiento de modelos grandes de ciclo largo en China solo puede satisfacer menos del 47 % de la demanda del mercado, y el déficit de potencia de cálculo de entrenamiento de alta gama representa alrededor del 35 % de la demanda efectiva.
Perspectiva SMM: La oferta de GPU Nvidia está bloqueada por controles comerciales, mientras que la demanda de cálculo inteligente creció un 417 %. Es poco probable que la brecha entre oferta y demanda de potencia de cálculo de alta gama se cierre en el futuro visible de los próximos 3–5 años, lo que coincide exactamente con los períodos de bloqueo de los contratos fijos.
4. Lado de la sustitución: las tarjetas nacionales aún están rezagadas respecto a la arquitectura CUDA en cuanto a entorno de desarrollo
El impulsor estructural del arrendamiento mínimo de tres años para servidores GPU Nvidia es la brecha actual para reemplazar Nvidia con potencia de cálculo nacional. En términos de entorno de desarrollo, la popularidad del ecosistema CUDA de Nvidia supera a la de los entornos de desarrollo nacionales (datos globales; el entorno de desarrollo de IA en China es homogéneo):
GPU cuota de mercado : Nvidia ostenta alrededor del 86 %–92 % del mercado global de GPU para centros de datos (según Silicon Analysts 2026.2 / Jon Peddie Research Q3 2025).
Escala de desarrolladores : Según Nvidia, 6 millones de desarrolladores en todo el mundo usan CUDA, y sobre él se han acumulado más de 400 bibliotecas optimizadas (cuDNN/NCCL/TensorRT, etc.).
Estándar de facto de los frameworks : Los backends GPU predeterminados para PyTorch y TensorFlow son ambos CUDA; aproximadamente el 85 % de los artículos de aprendizaje profundo usan PyTorch (más del 90 % en la conferencia principal NeurIPS), y alrededor del 87 % de los modelos en Hugging Face están en formato PyTorch.
Abismo ecosistémico : La imagen oficial nvidia/cuda ha sido descargada acumulativamente unas 105 millones de veces, mientras que la imagen más cercana de AMD ROCm ha sido descargada menos de 1 millón de veces: una diferencia de un orden de magnitud .
SMM Perspectiva: La potencia de cálculo pura de la Ascend 910B2 de Huawei se ha acercado o incluso superado ligeramente a la Nvidia A100, y la brecha real de rendimiento en escenarios de inferencia a menudo se reduce al 10 %–15 %. Lo realmente difícil de sustituir es el entrenamiento a gran escala, la precisión FP8 y el coste de migración del ecosistema CUDA/CANN (la migración de modelos Ascend requiere reescribir operadores, con un ciclo de alrededor de 1 a 4 semanas). Por tanto, los clientes de entrenamiento de alta gama prefieren aceptar un contrato fijo de 3 años con tarjetas importadas antes que conformarse con un contrato corto de un año con tarjetas nacionales: no es una cuestión de precio, sino de entrega y ejecución reales de las tareas .
5. Observaciones de primera línea: los gerentes de proyecto pasan de “captar el lado de la demanda” a “recorrer la cadena de suministro aguas arriba”
Las microseñales de tensión en la cadena de suministro ya se han transmitido desde las hojas de cotización a la rutina diaria de los profesionales. Según SMM entiende , el foco diario de los gerentes de proyecto de potencia de cálculo de las operadoras de telecomunicaciones está experimentando un cambio de rol:
En el pasado : El campo de batalla principal de los gerentes de proyecto estaba en el lado del cliente: ampliar la demanda, negociar acuerdos y competir en precios, lo que correspondía a un mercado donde la potencia de cálculo era sobreabundante y tenían que buscar clientes.
Ahora : El campo de batalla principal se ha desplazado a los proveedores de equipos aguas arriba en la cadena de suministro: programar producción, disputar cuotas, organizar canales de dispositivos de cálculo de alta gama y asegurar mercancía con los OEM de servidores, lo que corresponde a un mercado donde la potencia de cálculo de alta gama es extremadamente escasa. Al mismo tiempo, el mercado de transacciones de alquiler de potencia de cálculo es caótico, carece de cotizaciones unificadas y estandarizadas; existen muchos intermediarios y agentes en el sector. En un grupo de WeChat de alquiler de potencia de cálculo de 200 personas con información activa de transacciones, hay 76 intermediarios, lo que representa hasta un 38 %. Identificar canales de suministro de equipos de potencia de cálculo genuinos que puedan conectar directamente con el propietario de la carga también es una dificultad en el trabajo diario de los gerentes de las operadoras.
La evidencia pública es igualmente clara: el plazo de entrega de los servidores de IA nacionales se ha extendido de un promedio de 4 semanas en 2025 a 16-20 semanas en el segundo trimestre de 2026—"gestionando la cadena de suministro" en lugar de "perseguir clientes"—la nota al pie de mercado más auténtica sobre la escasez de servidores.
VI. Conclusión y perspectivas: contratos cerrados como “herramienta de cobertura” en medio de una cadena de suministro tensionada
SMM cree: los alquileres de GPU Nvidia suelen exigir contratos cerrados de tres o cinco años, lo que esencialmente establece un mecanismo de cobertura y bloqueo para hacer frente a la escasez de suministro de equipos y a la oferta restringida bajo presión de sanciones —el arrendatario intercambia liquidez de duración por “disponibilidad de potencia de cómputo + certeza de precio”, mientras que el arrendador asegura capacidad escasa y flujo de caja estable mediante acuerdos a largo plazo. Así, la duración del contrato se convierte en el indicador más directo de la escasez de potencia de cómputo de alta gama. La diferencia clave es que el contrato corto de un año para tarjetas nacionales refleja un exceso de oferta; el contrato cerrado de tres años de Nvidia representa una oferta insuficiente— los mismos términos contractuales plasman sobrecapacidad en un lado y crisis de la cadena de suministro en el otro . Cuando la duración del contrato empieza a poner precio al mercado, el arrendamiento de potencia de cómputo ya ha evolucionado de alquilar máquinas a un modelo de negocio centrado en recursos, duración y crédito.
Perspectivas para la industria de arrendamiento de potencia de cómputo:
Corto plazo (3–6 meses): Dado que los controles de exportación se mantienen firmes y el ritmo de revisión caso por caso para H200 no cambia, el arrendamiento inicial cerrado de tres años seguirá siendo el plazo principal para los arrendadores de potencia de cómputo en el oeste de China y el delta del río Yangtsé, mientras que las concesiones cerradas de cinco años se mantendrán bajas.
Medio plazo (6–12 meses): Si el aumento de la capacidad HBM/CoWoS (se espera que la nueva oferta se libere a partir del segundo semestre de 2026) alivia la estrechez global, los descuentos por contrato cerrado en tarjetas importadas podrían ampliarse ligeramente; pero la lógica de “bloqueo de recursos” no se revertirá.
Largo plazo (más de 1 año): La variable central radica en los avances reales de la sustitución nacional: si el Huawei Ascend 950 y las iteraciones posteriores llenan sustancialmente la brecha del ecosistema de entrenamiento, el “sistema de doble vía” de las duraciones de los contratos convergerá a medida que aumente el poder de negociación de las tarjetas nacionales; en ese punto, el límite entre contratos cortos de un año y contratos cerrados de tres años se redibujará a favor del campo nacional.

![[SMM Computing Power Express] Cierto proveedor de servicios de computación inteligente: H100 con plazo de 3 años desde 75.000 yuan/mes](https://imgqn.smm.cn/usercenter/yhuhG20251217171735.jpg)
![[SMM Computing Power Express] 20 máquinas de 8 tarjetas 5090 sin conexión a red en alquiler en el sur de China, alquiler mensual de 13.000](https://imgqn.smm.cn/usercenter/kLgYV20251217171736.jpg)
