【Analisis SMM】 Penyewaan GPU Domestik versus Nvidia: Kontrak Tahunan versus Kontrak 3–5 Tahun di Tengah Pergeseran Pasokan dan Permintaan

Telah Terbit: Aug 5, 2026 13:16
Di pasar sewa daya komputasi yang sama, garis pemisah yang jelas dalam durasi kontrak mulai muncul: seri Huawei Ascend 910B/910C di Tiongkok daratan umumnya disewakan mulai dari satu tahun. Sumber daya sewa NVIDIA H100/H200 biasanya mensyaratkan kontrak terkunci minimal tiga tahun, dengan kelonggaran untuk kontrak lima tahun yang masih terbatas. Di bawah kendali ekspor, daya komputasi telah bergeser dari "komoditas" menjadi "sumber daya langka"—dan durasi kontrak justru merupakan harga dari kelangkaan itu.

1. Fenomena: Dalam rantai industri penyewaan daya komputasi yang sama, ketentuan kontrak sewa untuk server GPU domestik dan server GPU Nvidia

terdapat perbedaan yang jelas antara persyaratan kontrak sewa daya komputasi domestik dan daya komputasi Nvidia. Server domestik dapat disewa per tahun, sementara server Nvidia umumnya mensyaratkan kontrak tetap minimal tiga tahun.

Kartu domestik berada dalam “pasar pembeli” : Ascend 910B2 mengalami tingkat kekosongan tinggi dan harga penawaran lebih rendah di sejumlah daerah. Operator dan lessor menawarkan kontrak jangka pendek satu tahun untuk mendapatkan likuiditas, yang mencerminkan penetapan harga khas kelebihan pasokan.

Kartu impor berada dalam “pasar penjual” : Untuk H100/H200, tidak hanya masa sewa minimum yang tetap, tetapi kontrak tetap lima tahun hanya sekitar 3.000–5.000 yuan/bulan lebih murah dibandingkan kontrak tiga tahun (menurut sumber SMM) — jika pembeli menandatangani kontrak lima tahun demi menghemat biaya, diskonnya tidak cukup untuk menutupi risiko periode penguncian tambahan dua tahun. Fakta bahwa pembeli bersedia menerimanya justru menunjukkan kebutuhan inti adalah “memastikan akses kartu dalam lima tahun ke depan”, bukan harga .

SMM Analisis: Klausul jangka waktu kontrak telah menjadi alat bagi sisi suplai untuk “menyaring klien berdasarkan durasi kontrak” — kartu domestik memanfaatkan kontrak pendek untuk menarik klien, kartu Nvidia mengunci klien dengan kontrak panjang.

 

2. Sisi Suplai: Sanksi embargo GPU Nvidia mengunci pasokan

Berikut linimasa kontrol Departemen Perdagangan AS atas ekspor chip kelas atas seperti Nvidia H100 dan B300 ke Tiongkok:

SMM Wawasan: Dari H100, H800 hingga H200, pasokan kartu kelas atas ke Tiongkok selama empat tahun terakhir berada dalam siklus “kontrol—perketatan—kliring terbatas”; “peninjauan per kasus” untuk H200 juga berarti setiap pengiriman penuh dengan ketidakpastian. Bagi penyewa, jika hari ini tidak mengunci sumber daya, besok mungkin tidak dapat membelinya — inilah logika suplai paling mendasar di balik kontrak tetap 3 tahun/5 tahun.

 

3. Sisi Permintaan: Daya komputasi cerdas memasuki masa pertumbuhan eksplosif, dan celah suplai-permintaan melebar

Ledakan permintaan komputasi cerdas telah mengubah “penguncian sumber daya” dari opsi menjadi keniscayaan dalam penyewaan daya komputasi:

Total kapasitas komputasi cerdas meningkat signifikan : Menurut data yang diungkap Kementerian Perindustrian dan Teknologi Informasi pada 20 Juli 2026, per akhir Juni 2026, kapasitas komputasi cerdas Tiongkok mencapai 2.185 EFLOPS (FP16) , naik sekitar 37% dari sekitar 1.590 EFLOPS pada akhir 2025. Di antaranya, wilayah barat menyumbang 32,6%, dan tingkat utilisasi fasilitas komputasi nasional sebesar 71,4%.

Celah semakin melebar : Menurut data CAICT, pada kuartal I 2026, permintaan komputasi AI domestik melonjak 417% YoY , sementara pertumbuhan suplai hanya sekitar 128% — pertumbuhan permintaan sekitar 3,3 kali lipat dari pasokan.

Celah struktural : Menurut estimasi publik industri, suplai efektif daya komputasi kelas atas yang dibutuhkan untuk pelatihan siklus panjang model besar di Tiongkok hanya mampu memenuhi kurang dari 47% permintaan pasar, dan kekurangan daya komputasi pelatihan kelas atas mencapai sekitar 35% dari permintaan efektif.

Wawasan SMM: Pasokan GPU Nvidia terkunci oleh kontrol perdagangan, sementara permintaan komputasi cerdas tumbuh 417%. Celah suplai-permintaan daya komputasi kelas atas tidak mungkin tertutup dalam masa mendatang, 3–5 tahun ke depan, yang tepat sesuai dengan periode penguncian kontrak tetap.

 

4. Sisi Substitusi: Kartu domestik masih tertinggal dari arsitektur CUDA dalam hal lingkungan pengembangan

Pendorong struktural di balik sewa minimal tiga tahun untuk server GPU Nvidia adalah kesenjangan saat ini dalam menggantikan Nvidia dengan daya komputasi domestik. Dari segi lingkungan pengembangan, popularitas ekosistem CUDA Nvidia memimpin lingkungan pengembangan domestik (data global; lingkungan pengembangan AI Tiongkok bersifat homogen):

Pangsa pasar GPU : Nvidia menguasai sekitar 86%–92% pasar GPU pusat data global (menurut Silicon Analysts 2026.2 / Jon Peddie Research Q3 2025).

Skala pengembang : Menurut Nvidia, 6 juta pengembang di seluruh dunia menggunakan CUDA, dan lebih dari 400 pustaka yang dioptimalkan (cuDNN/NCCL/TensorRT, dll.) telah terakumulasi di atasnya.

Standar de facto kerangka kerja : Backend GPU default untuk PyTorch dan TensorFlow keduanya CUDA; sekitar 85% makalah pembelajaran mendalam menggunakan PyTorch (lebih dari 90% di konferensi top NeurIPS), dan sekitar 87% model di Hugging Face berformat PyTorch.

Jurang ekosistem : Citra resmi nvidia/cuda telah ditarik sekitar 105 juta kali secara kumulatif, sementara citra AMD ROCm terdekat ditarik kurang dari 1 juta kali — kesenjangan satu orde magnitudo .

SMM Wawasan: Daya komputasi murni Ascend 910B2 Huawei telah mendekati atau bahkan sedikit melampaui Nvidia A100, dan celah throughput aktual dalam skenario inferensi sering kali menyempit menjadi 10%–15%. Yang benar-benar sulit diganti adalah pelatihan skala besar, presisi FP8, dan biaya migrasi ekosistem CUDA/CANN (migrasi model Ascend memerlukan penulisan ulang operator, dengan siklus sekitar 1–4 minggu). Karena itu, klien pelatihan kelas atas lebih memilih menerima kontrak tetap 3 tahun untuk kartu impor daripada berpuas diri dengan kontrak jangka pendek satu tahun untuk kartu domestik — ini bukan soal harga, melainkan soal penyelesaian dan eksekusi tugas yang sesungguhnya .

 

5. Observasi Garis Depan: Manajer proyek beralih dari “menjemput permintaan” ke “menjemput rantai suplai hulu”

Sinyal mikro ketatnya rantai pasokan telah ditransmisikan dari lembar penawaran ke rutinitas harian para praktisi. Menurut pemahaman SMM , fokus harian manajer proyek daya komputasi operator telekomunikasi tengah mengalami pergeseran peran:

Dulu : Medan tempur utama manajer proyek berada di sisi klien — memperluas permintaan, menegosiasikan bisnis, bersaing harga, sejalan dengan pasar yang daya komputasinya berlebih sehingga mereka harus mencari klien.

Kini : Medan tempur utama telah bergeser ke pemasok peralatan hulu dalam rantai suplai — menjadwalkan produksi, memperebutkan kuota, memilah saluran perangkat komputasi kelas atas, dan mengunci barang dengan OEM server, sejalan dengan pasar yang daya komputasi kelas atasnya sangat langka. Di saat yang sama, pasar transaksi penyewaan daya komputasi kacau, minim penawaran yang seragam dan terstandarisasi; banyak perantara dan agen di dalam industri ini. Dalam grup WeChat penyewaan daya komputasi beranggotakan 200 orang dengan informasi transaksi aktif, terdapat 76 perantara, mencapai 38%. Mengidentifikasi saluran pasokan peralatan daya komputasi asli yang dapat langsung terhubung ke pemilik barang juga merupakan kesulitan dalam pekerjaan sehari-hari para manajer operator.
Bukti publik sama jelasnya: waktu tunggu pengiriman server AI domestik telah memanjang dari rata-rata 4 minggu pada tahun 2025 menjadi 16–20 minggu pada Q2 2026—"menjalankan rantai pasok" alih-alih "mengejar klien"—catatan pasar paling autentik atas ketatnya pasokan server.

 

VI. Kesimpulan dan Prospek: Kontrak Tertutup sebagai “Alat Lindung Nilai” di Tengah Rantai Pasok yang Ketat

SMM berpendapat: Sewa GPU Nvidia umumnya mensyaratkan kontrak tertutup tiga atau lima tahun, yang pada dasarnya membentuk mekanisme lindung nilai dan penguncian untuk mengatasi kekurangan pasokan peralatan serta pasokan ketat di bawah tekanan sanksi —penyewa menukar likuiditas durasi dengan “ketersediaan daya komputasi + kepastian harga,” sementara pemberi sewa mengunci kapasitas langka dan arus kas stabil melalui perjanjian jangka panjang. Durasi kontrak dengan demikian menjadi indikator paling langsung atas kelangkaan daya komputasi kelas atas. Perbedaan utamanya adalah kontrak pendek satu tahun untuk kartu domestik mencerminkan kelebihan pasokan; kontrak tertutup tiga tahun Nvidia mencerminkan kekurangan pasokan— ketentuan kontrak yang sama menuliskan kelebihan kapasitas di satu sisi dan krisis rantai pasok di sisi lain . Ketika durasi kontrak mulai menentukan harga pasar, penyewaan daya komputasi telah berevolusi dari sekadar menyewa mesin menjadi model bisnis yang berpusat pada sumber daya, durasi, dan kredit.

Prospek Industri Penyewaan Daya Komputasi:

Jangka pendek (3–6 bulan): Dengan kontrol ekspor yang tetap ketat dan laju peninjauan kasus per kasus untuk H200 yang tidak berubah, sewa awal kontrak tertutup tiga tahun akan tetap menjadi jangka waktu utama bagi pemberi sewa daya komputasi di Tiongkok barat dan Delta Sungai Yangtze, sementara konsesi kontrak tertutup lima tahun akan tetap rendah.

Jangka menengah (6–12 bulan): Jika peningkatan kapasitas HBM/CoWoS (pasokan baru diharapkan mulai dirilis pada H2 2026) meredakan ketatnya pasokan global, diskon kontrak tertutup kartu impor mungkin sedikit melebar; namun logika “penguncian sumber daya” tidak akan berbalik.

Jangka panjang (lebih dari 1 tahun): Variabel intinya terletak pada terobosan aktual substitusi domestik—jika Huawei Ascend 950 dan iterasi berikutnya secara substansial mengisi kesenjangan ekosistem pelatihan, “sistem jalur ganda” durasi kontrak akan menyatu seiring meningkatnya daya tawar kartu domestik; pada titik itu, batas antara kontrak pendek satu tahun dan kontrak tertutup tiga tahun akan digambar ulang untuk menguntungkan kubu domestik.

Pernyataan Sumber Data: Kecuali informasi yang tersedia untuk publik, semua data lainnya diproses oleh SMM berdasarkan informasi publik, komunikasi pasar, dan mengandalkan model database internal SMM. Hanya untuk referensi dan tidak menjadi rekomendasi pengambilan keputusan.

Gambar dalam artikel ini berisi keterangan yang diterjemahkan oleh AI hanya untuk referensi.

Untuk pertanyaan atau informasi lebih lanjut, silakan hubungi: lemonzhao@smm.cn
Untuk informasi lebih lanjut tentang cara mengakses laporan penelitian kami, hubungi:service.en@smm.cn
Berita Terkait
Musk Memuji Arsitektur AI NVIDIA, Memproyeksikan Kapasitas Komputasi SpaceX Capai 10 GW pada 2024
1 jam yang lalu
Musk Memuji Arsitektur AI NVIDIA, Memproyeksikan Kapasitas Komputasi SpaceX Capai 10 GW pada 2024
Baca Selengkapnya
Musk Memuji Arsitektur AI NVIDIA, Memproyeksikan Kapasitas Komputasi SpaceX Capai 10 GW pada 2024
Musk Memuji Arsitektur AI NVIDIA, Memproyeksikan Kapasitas Komputasi SpaceX Capai 10 GW pada 2024
Dalam panggilan laba pertama perusahaan, CEO SpaceX Elon Musk mengatakan bahwa perusahaan tersebut menganggap arsitektur Vera Rubin milik NVIDIA sebagai 'arsitektur komputasi AI terbaik.' Musk mengungkapkan bahwa SpaceX memperkirakan kapasitas komputasinya akan melebihi 2 gigawatt (GW) pada akhir tahun ini dan mendekati 10 GW pada akhir tahun depan.
1 jam yang lalu
[SMM Ekspres Daya Komputasi] Penyedia layanan komputasi cerdas tertentu: H100 jangka waktu 3 tahun mulai dari 75.000 yuan/bulan
3 jam yang lalu
[SMM Ekspres Daya Komputasi] Penyedia layanan komputasi cerdas tertentu: H100 jangka waktu 3 tahun mulai dari 75.000 yuan/bulan
Baca Selengkapnya
[SMM Ekspres Daya Komputasi] Penyedia layanan komputasi cerdas tertentu: H100 jangka waktu 3 tahun mulai dari 75.000 yuan/bulan
[SMM Ekspres Daya Komputasi] Penyedia layanan komputasi cerdas tertentu: H100 jangka waktu 3 tahun mulai dari 75.000 yuan/bulan
SMM mengetahui bahwa penyedia layanan komputasi cerdas melaporkan penawaran sewa tiga tahun untuk H100 berikut rak dan listrik saat ini sudah di atas 75.000 yuan/bulan. Untuk server RTX4090 8-GPU, mereka masih memiliki puluhan unit stok, dengan harga sewa bulanan versi memori 1TB sebesar 7.200 yuan sebagai harga dasar mereka. Harga pasar untuk versi memori 512GB serupa telah naik menjadi 8.000 yuan/bulan. SMM juga mengetahui bahwa kisaran penawaran untuk H200 adalah 120.000–135.000 yuan/bulan dan menunjukkan tren kenaikan minggu ini. Harga sewa kartu kelas atas tetap berada dalam jalur naik. Penyedia layanan tersebut mengatakan banyak perantara menaikkan harga di pasar, dan sumber daya langsung langka.
3 jam yang lalu
[SMM Computing Power Express] 20 mesin 8 kartu 5090 tanpa jaringan disewakan di Tiongkok Selatan, sewa bulanan 13.000
3 jam yang lalu
[SMM Computing Power Express] 20 mesin 8 kartu 5090 tanpa jaringan disewakan di Tiongkok Selatan, sewa bulanan 13.000
Baca Selengkapnya
[SMM Computing Power Express] 20 mesin 8 kartu 5090 tanpa jaringan disewakan di Tiongkok Selatan, sewa bulanan 13.000
[SMM Computing Power Express] 20 mesin 8 kartu 5090 tanpa jaringan disewakan di Tiongkok Selatan, sewa bulanan 13.000
SMM telah mengetahui bahwa sebuah penyedia layanan daya komputasi di Tiongkok Selatan telah merilis 20 server RTX 5090 8-GPU untuk disewakan, dengan harga sewa bulanan sebesar 13.000 yuan per unit. Batch mesin ini ditempatkan sebagai unit mandiri tanpa interkoneksi jaringan, cocok untuk skenario ringan seperti inferensi terdistribusi atau rendering. SMM berpendapat bahwa konfigurasi non-jaringan menawarkan fleksibilitas tinggi dan hambatan masuk yang rendah, namun kurangnya interkoneksi klaster berarti kemampuan adaptasi yang terbatas untuk pelatihan skala besar dan tugas terdistribusi; penyewa harus mengevaluasi berdasarkan skenario spesifik mereka.
3 jam yang lalu