I. Ringkasan Acara
Pada 24 April 2026, DeepSeek resmi merilis versi pratinjau model besar seri V4, termasuk model unggulan DeepSeek-V4-Pro (total 1,6 triliun parameter / 49 miliar parameter aktif) dan model ringan DeepSeek-V4-Flash (total 284 miliar parameter / 13 miliar parameter aktif). Keduanya mendukung jendela konteks 1 juta token secara native dan sepenuhnya bersumber terbuka di bawah lisensi MIT. Seri V4 mulai tersedia secara resmi pada 20 Juli, dan API versi resmi V4-Flash-0731 diluncurkan untuk pengujian publik pada 31 Juli.
Pada hari yang sama, DeepSeek mengumumkan penurunan harga permanen 75% untuk API V4-Pro. Dalam skenario cache-hit, harga input turun hingga 0,025 yuan per juta token, dengan output 6 yuan per juta token—harga rendah baru di antara model-model mutakhir global.
II. Terobosan Teknologi: Bukan Hanya Soal Murah
Seri V4 memperkenalkan tiga teknologi inti:
- Arsitektur Perhatian Hibrida (CSA + HCA) : Menggabungkan perhatian jarang terkompresi dengan perhatian terkompresi berat. Dalam konteks 1 juta token, komputasi inferensi hanya 27% dari V3.2, dan cache KV hanya menggunakan 10%.
- Hyperconnection Terkendali Beraneka Ragam (mHC) : Menggantikan koneksi residual tradisional, memastikan stabilitas pelatihan untuk jaringan dengan puluhan ribu lapisan.
- Pelatihan dan Inferensi Presisi Campuran FP4/FP8 : Implementasi pertama di industri. Mengurangi tekanan bandwidth VRAM sebesar 50% dan menggandakan efisiensi inferensi.
Pada SWE-bench Verified (kemampuan coding), V4-Pro mencetak 80,6%, memimpin semua model sumber terbuka dan hampir menyamai 80,8% milik Claude Opus 4.6. Model ini mencetak 87,5% pada MMLU-Pro dan 85,0% pada penalaran matematika AIME 2025. Dalam laporan teknisnya, DeepSeek mengakui “sedikit tertinggal dari GPT-5.4 dan Gemini-3.1-Pro sekitar 3–6 bulan,” tetapi mengingat kesenjangan harga, hal ini hampir tidak relevan.
III. Perang Harga: “Garis Eksekusi” untuk Model Besar Global
Penetapan harga V4-Pro langsung meruntuhkan sistem harga model besar global. Berikut adalah perbandingan harga output untuk model-model utama pada Juli 2026 (dalam dolar AS per juta token):
Grafik-1: Perbandingan Harga Output API untuk Model Utama pada Juli 2026 (Skala Logaritmik)

Komunitas pengembang di luar China telah mencapai konsensus: Untuk sebagian besar skenario C-end dan B-end skala kecil-menengah, menanggung biaya inferensi puluhan kali lipat demi peningkatan performa marjinal tidak memiliki kelayakan komersial. Bagi pesaing yang harganya lebih tinggi dari DeepSeek, hanya dua jalur yang tersisa: memotong harga secara signifikan secara proaktif, atau sepenuhnya meninggalkan pasar pengembang massal.
Grafik-2: Perbandingan Tolok Ukur Inti (Diagram Radar)

IV. Dampak pada Model Utama
4.1 OpenAI: Dari Arogansi ke Pemotongan Harga Mendesak
OpenAI terkena dampak paling langsung. Pada 2025, pendapatan tahunannya $13 miliar, total pengeluaran $34 miliar, dan rugi bersih $39 miliar, dengan sekitar $8 miliar merupakan kerugian operasional.
Pada 30 Juli 2026, hanya tiga minggu setelah peluncuran GPT-5.6, OpenAI dengan mendesak mengumumkan pemotongan harga 80% untuk versi Luna. CEO Sam Altman secara terbuka mengakui bahwa biaya adalah "tantangan terbesar dalam industri" dan menyatakan bahwa "OpenAI senang memotong harga hingga 75%," yang ditafsirkan oleh para pengamat sebagai tanggapan pasif terhadap DeepSeek.
Di platform OpenRouter, konsumsi token mingguan oleh model China telah melampaui 60%, sementara model AS turun ke bawah 20% [9]. Data dari platform cloud AS Vercel menunjukkan bahwa pangsa penggunaan model DeepSeek di pasar perusahaan melonjak dari 1% pada April menjadi 17% pada Mei.
4.2 Anthropic: Strategi Harga Tinggi di Bawah Tekanan
Claude Fable 5 dihargai $50 per juta token output, 57 kali lipat dari V4-Pro. Pada Juni 2026, Anthropic mulai melarang pengguna di luar China menggunakan Claude, secara proaktif mengecilkan pasarnya—ditafsirkan sebagai langkah yang dipaksakan oleh biaya komputasi yang terlalu tinggi untuk fokus pada pasar ARPU tinggi.
4.3 Google: Kekurangan Daya Komputasi
Pesanan backlog Google Cloud telah mencapai $460 miliar, dan Gemini mulai menerapkan kuota penggunaan untuk klien besar seperti Meta.
4.4 Microsoft: Sinyal Pembelotan
Pada 16 Juni 2026, Microsoft secara resmi mulai mengevaluasi integrasi DeepSeek V4 ke dalam Copilot Cowork untuk menggantikan model OpenAI dan Anthropic. CEO Satya Nadella menyatakan secara terbuka: "Model yang lebih murah dan pilihan yang lebih luas akan meningkatkan kepercayaan masyarakat terhadap AI; publik tidak akan mentolerir beberapa model dan perusahaan yang memonopoli semua pembelajaran." Mengingat kepemilikan saham Microsoft sebesar 27% di OpenAI, pernyataan ini mengguncang industri.
4.5 Nvidia: Retaknya Parit CUDA
Pada hari peluncuran DeepSeek V4, model ini berhasil diadaptasi penuh di delapan produsen GPU utama China: Huawei Ascend, Cambricon, Hygon, Moore Threads, Muxi, Kunlun Core, Alibaba T-Head, dan Tianjic. Bernstein memprediksi bahwa pangsa pasar akselerator AI Nvidia di China akan turun dari 95% menjadi sekitar 8% pada 2026, sementara Huawei Ascend akan naik menjadi 50%–62%.
Grafik-3: Linimasa Peristiwa Penting Perang Harga Model Besar 2026

V. Kegilaan Modal: Valuasi 500 Miliar
Pada Juni 2026:DeepSeek menyelesaikan putaran pertama pendanaan eksternal melebihi 50 miliar yuan, dengan valuasi melampaui $50 miliar. Investor termasuk Liang Wenfeng yang secara pribadi menyumbang 20 miliar yuan, Tencent 10 miliar yuan, CATL 5 miliar yuan, JD.com 3 miliar yuan, dan Dana Investasi Industri AI Nasional.
Agustus 2026:DeepSeek meluncurkan putaran kedua pendanaan 50 miliar yuan, dengan valuasi pra-uang sekitar 500 miliar yuan (sekitar $74 miliar).
Total valuasi empat laboratorium AI murni utama China telah mencapai sekitar $159 miliar, naik dari hampir nol 18 bulan lalu.
VI. Data Pasar: Model China Mendominasi Peringkat Penggunaan Global
Grafik-4: Pangsa Panggilan Token Global di Platform OpenRouter (27 Juli – 2 Agustus)

VII. Pembalikan dan Kekhawatiran
7.1 Krisis Daya Komputasi, Harga Akan Naik
Pada 6 Agustus, DeepSeek mengumumkan akan "menaikkan harga API secara signifikan." Daya komputasinya saat ini setara dengan hanya sekitar 20.000 GPU H100, jauh di belakang pesaing AS seperti OpenAI.
7.2 Risiko Politik
Pemerintah AS sangat waspada terhadap model DeepSeek yang memasuki infrastruktur perusahaan AS. Bahkan ketika diterapkan di pusat data Azure AS milik Microsoft, mereka tetap menghadapi tinjauan keamanan.
7.3 Paradoks Komersialisasi
Rasio harga terhadap penjualan (P/S) V4-Pro melampaui 3.800 kali, puluhan kali lipat dari Anthropic, tetapi pendapatan tahunannya sangat rendah. Logika penetapan harga Liang Wenfeng adalah bahwa "mengembalikan biaya server dalam 10 bulan dianggap sebagai laba yang wajar," dan investor menghadapi risiko inversi valuasi.
VIII. Komentar SMM
SMM mengomentari hal ini. Pertama,tolok ukur penetapan harga model besar global telah bergeser dari pemahaman diam-diam di antara tiga oligarki Silicon Valley ke "garis pembunuh" yang ditentukan oleh DeepSeek. Sementara itu, rute efisiensi ekstrem MoE + sparse attention + mixed precision menunjukkan bahwa kinerja mutakhir tidak harus bergantung pada penumpukan daya komputasi. Di sisi ekosistem, chip domestik seperti Huawei Ascend telah memperoleh peluang praktis skala besar, dan penghalang CUDA sedang terguncang,akhir dari persaingan model besar global mungkin tidak dimenangkan oleh model terkuat, juga bukan oleh model termurah, melainkan oleh solusi optimal pada kurva kinerja-biaya "kapabilitas/biaya", yang akan menjadi pemenang akhir.
Referensi
- DeepSeek V4 Pro Hadir dengan Konteks 1 Juta Token, Membentuk Ulang Kalkulus Biaya Kita — —
- Wiki AI —
- DeepSeek Menjadi Garis Pembunuh AI Global —
- DeepSeek-V4-Pro: Model Sumber Terbuka yang Menulis Ulang Aturan AI —
- DeepSeek dan Zhipu Menerobos Blokade Daya Komputasi: Model Zhipu Masuk Tiga Besar, DeepSeek Mengurangi Biaya Menjadi 1/20 —
- Bagaimana DeepSeek dan Alibaba Menghancurkan Hambatan Harga AI: Selisih Biaya 70 Kali Lipat Membentuk Ulang Lanskap Industri Global —
- Setelah Rilis Resmi DeepSeek-V4-Flash, Produsen Model Terkemuka Seperti OpenAI Memotong Harga —
- Perang Harga Inferensi AI Dijelaskan —
- Biaya Inferensi DeepSeek Turun ke 1/36 dari GPT-4o, Bagaimana Ini Akan Menulis Ulang Aturan Industri? —
- Infrastruktur AI Telah Menjadi Jenis Bisnis yang Paling Dibenci Munger —
- Microsoft Mengevaluasi Penggunaan Model DeepSeek V4 untuk Memotong Biaya dan Meningkatkan Efisiensi, Berpotensi Menggantikan OpenAI dan Anthropic —
- Perang Harga AI 2026: Mengapa Pemenang Sebenarnya Bukan DeepSeek atau OpenAI —
- Google menjatah Gemini untuk Meta: ketika komputasi menjadi sumber daya paling langka —
- Microsoft Melirik DeepSeek V4 untuk Copilot Cowork: Apa yang Tidak Bisa Diperbaiki oleh Hosting Azure —
- Ledakan Chip Domestik: Hal yang Paling Ditakuti Nvidia Telah Tiba —
- Migrasi Besar Daya Komputasi AI: 2026, Tiga Pergeseran Serentak —
- DeepSeek Mengumpulkan $7,4 Miliar pada Valuasi $50 Miliar dalam Putaran Pendanaan Eksternal Pertama —
- Laporan: DeepSeek Telah Memulai Kembali Putaran Kedua Pendanaan 50 Miliar Yuan —
- Valuasi Setinggi 500 Miliar Yuan, DeepSeek Memimpin Peringkat Panggilan Model Besar Global —
- Harga Murah Berakhir! DeepSeek Akan Menaikkan Harga Secara Signifikan —
- Bagaimana Prospek Pengembangan DeepSeek di Masa Depan? —
![[Ulasan Siang Daya Komputasi SMM] Harga terendah 4090 di Delta Sungai Yangtze naik, dan daya tawar untuk daya komputasi inferensi di Tiongkok timur bergeser ke sisi pasokan.](https://imgqn.smm.cn/usercenter/ipCjz20251217171734.jpeg)
![[SMM Computing Power Express] Penyedia layanan cloud komputasi cerdas tertentu menawarkan sewa bulanan sebesar 7.200 yuan per unit per bulan untuk server delapan kartu 4090, lebih tinggi dari penawaran rendah sebelumnya.](https://imgqn.smm.cn/usercenter/SSKOK20251217171734.jpeg)
![Lonjakan permintaan daya komputasi AI mendorong kenaikan berkelanjutan pada operasi foil tembaga; konektor kabel tembaga berkecepatan tinggi menguat, Taichenguang memimpin kenaikan [SMM Express]](https://imgqn.smm.cn/usercenter/tXxfd20251217171713.jpg)
