[Phân tích SMM] DeepSeek thiết lập "Đường sát thủ", định hình lại quyền định giá mô hình lớn toàn cầu

Đã xuất bản: Aug 11, 2026 13:12
DeepSeek V4 Pro đã châm ngòi cuộc chiến giá toàn cầu giữa các mô hình ngôn ngữ lớn với mức giá siêu thấp. OpenAI giảm giá 80%, Anthropic rút lui khỏi thị trường ngoài Trung Quốc, Microsoft đang đánh giá tích hợp, và thị phần GPU của Nvidia tại Trung Quốc lao dốc từ 95% xuống 8%. Các mô hình Trung Quốc chiếm 60% tổng lưu lượng cuộc gọi trên OpenRouter, dẫn trước các mô hình Mỹ trong 14 tuần liên tiếp.

I. Tổng quan sự kiện

Vào ngày 24 tháng 4 năm 2026, DeepSeek chính thức phát hành phiên bản xem trước của dòng mô hình lớn V4, bao gồm mô hình chủ lực DeepSeek-V4-Pro (tổng 1,6 nghìn tỷ tham số / 49 tỷ tham số kích hoạt) và mô hình nhẹ DeepSeek-V4-Flash (tổng 284 tỷ tham số / 13 tỷ tham số kích hoạt). Cả hai đều hỗ trợ cửa sổ ngữ cảnh 1 triệu token và được mở nguồn hoàn toàn theo giấy phép MIT. Dòng V4 chính thức khả dụng từ ngày 20 tháng 7 và API phiên bản chính thức V4-Flash-0731 bắt đầu thử nghiệm công khai vào ngày 31 tháng 7.

Cùng ngày, DeepSeek công bố giảm giá vĩnh viễn 75% cho API V4-Pro. Trong các tình huống trúng bộ nhớ đệm, giá đầu vào chỉ còn 0,025 nhân dân tệ mỗi triệu token, đầu ra là 6 nhân dân tệ mỗi triệu token — mức giá thấp kỷ lục trong số các mô hình tiên tiến toàn cầu.


II. Đột phá công nghệ: Không chỉ là giá rẻ

Dòng V4 giới thiệu ba công nghệ cốt lõi:

  1. Kiến trúc chú ý lai (CSA + HCA) : Kết hợp chú ý thưa nén với chú ý nén nặng. Với ngữ cảnh 1 triệu token, tính toán suy luận chỉ bằng 27% so với V3.2 và bộ đệm KV chỉ sử dụng 10%.
  2. Siêu kết nối ràng buộc đa tạp (mHC) : Thay thế kết nối dư truyền thống, đảm bảo sự ổn định huấn luyện cho các mạng có hàng chục nghìn lớp.
  3. Huấn luyện và suy luận hỗn hợp độ chính xác FP4/FP8 : Lần đầu tiên trong ngành. Giảm 50% áp lực băng thông VRAM và tăng gấp đôi hiệu quả suy luận.

Trên SWE-bench Verified (khả năng lập trình), V4-Pro đạt 80,6%, dẫn đầu tất cả các mô hình nguồn mở và gần bằng 80,8% của Claude Opus 4.6. Mô hình đạt 87,5% trên MMLU-Pro và 85,0% trên suy luận toán học AIME 2025. Trong báo cáo kỹ thuật, DeepSeek thừa nhận “tụt hậu một chút so với GPT-5.4 và Gemini-3.1-Pro khoảng 3–6 tháng”, nhưng xét đến chênh lệch giá, điều này gần như không đáng kể.


III. Cuộc tàn sát giá: “Đường ranh giới” cho các mô hình lớn toàn cầu

Giá của V4-Pro trực tiếp phá vỡ hệ thống định giá mô hình lớn toàn cầu. Dưới đây là so sánh giá đầu ra của các mô hình chính trong tháng 7 năm 2026 (tính bằng đô la Mỹ mỗi triệu token):

Biểu đồ 1: So sánh giá đầu ra API của các mô hình chính vào tháng 7 năm 2026 (Thang logarit)

Cộng đồng nhà phát triển ngoài Trung Quốc đã đạt được đồng thuận: Đối với đại đa số kịch bản C-end và B-end vừa và nhỏ, việc chịu chi phí suy luận gấp hàng chục lần để đổi lấy mức cải thiện hiệu suất biên không có tính khả thi thương mại. Với bất kỳ đối thủ nào có giá cao hơn DeepSeek, chỉ còn hai con đường: chủ động cắt giảm giá mạnh, hoặc từ bỏ hoàn toàn thị trường nhà phát triển đại chúng.

Biểu đồ 2: So sánh điểm chuẩn cốt lõi (Biểu đồ radar)


IV. Tác động đến các mô hình lớn

4.1 OpenAI: Từ kiêu ngạo đến khẩn cấp giảm giá

OpenAI bị ảnh hưởng trực tiếp nhất. Năm 2025, doanh thu hàng năm của họ là 13 tỷ đô, tổng chi tiêu 34 tỷ đô, lỗ ròng 39 tỷ đô, trong đó khoảng 8 tỷ đô là lỗ hoạt động.

Ngày 30 tháng 7 năm 2026, chỉ ba tuần sau khi phát hành GPT-5.6, OpenAI khẩn cấp thông báo giảm giá 80% cho phiên bản Luna. CEO Sam Altman công khai thừa nhận chi phí là "thách thức lớn nhất trong ngành" và tuyên bố rằng "OpenAI sẵn sàng giảm giá 75%," điều này được giới quan sát hiểu là phản ứng thụ động trước DeepSeek.

Trên nền tảng OpenRouter, mức tiêu thụ token hàng tuần của các mô hình Trung Quốc đã vượt 60%, trong khi của các mô hình Mỹ giảm xuống dưới 20% [9]. Dữ liệu từ nền tảng đám mây Mỹ Vercel cho thấy thị phần sử dụng mô hình DeepSeek trên thị trường doanh nghiệp tăng vọt từ 1% vào tháng 4 lên 17% vào tháng 5.

4.2 Anthropic: Chiến lược giá cao chịu áp lực

Claude Fable 5 có giá 50 đô cho mỗi triệu token đầu ra, gấp 57 lần V4-Pro. Tháng 6 năm 2026, Anthropic bắt đầu cấm người dùng ngoài Trung Quốc sử dụng Claude, chủ động thu hẹp thị trường—được hiểu là động thái bị buộc phải thực hiện do chi phí tính toán quá cao để tập trung vào các thị trường có ARPU cao.

4.3 Google: Thiếu hụt năng lực tính toán

Đơn đặt hàng tồn đọng của Google Cloud đã lên tới 460 tỷ đô, và Gemini đã bắt đầu áp dụng hạn mức sử dụng cho các khách hàng lớn như Meta.

4.4 Microsoft: Dấu hiệu rời bỏ

Ngày 16 tháng 6 năm 2026, Microsoft chính thức bắt đầu đánh giá tích hợp DeepSeek V4 vào Copilot Cowork để thay thế các mô hình OpenAI và Anthropic. CEO Satya Nadella công khai tuyên bố: "Các mô hình rẻ hơn và lựa chọn rộng hơn sẽ tăng cường niềm tin của xã hội vào AI; công chúng sẽ không dung thứ cho việc một vài mô hình và công ty độc quyền mọi hoạt động học tập." Với việc Microsoft nắm 27% cổ phần tại OpenAI, tuyên bố này đã gây chấn động ngành.

4.5 Nvidia: Hào lũy CUDA rạn nứt

Ngày phát hành DeepSeek V4, nó đã thích ứng hoàn toàn trên tám nhà sản xuất GPU lớn của Trung Quốc: Huawei Ascend, Cambricon, Hygon, Moore Threads, Muxi, Kunlun Core, Alibaba T-Head và Tianjic. Bernstein dự đoán thị phần của Nvidia trên thị trường tăng tốc AI tại Trung Quốc sẽ giảm từ 95% xuống khoảng 8% vào năm 2026, trong khi Huawei Ascend sẽ tăng lên 50%–62%.

Biểu đồ 3: Dòng thời gian các sự kiện chính của cuộc chiến giá mô hình lớn năm 2026


V. Cơn sốt vốn: Định giá 500 tỷ

Tháng 6 năm 2026:DeepSeek đã hoàn thành vòng gọi vốn bên ngoài đầu tiên vượt 50 tỷ nhân dân tệ, định giá vượt 50 tỷ đô la. Các nhà đầu tư bao gồm Liang Wenfeng cá nhân góp 20 tỷ nhân dân tệ, Tencent góp 10 tỷ nhân dân tệ, CATL góp 5 tỷ nhân dân tệ, JD.com góp 3 tỷ nhân dân tệ, và Quỹ Đầu tư Công nghiệp AI Quốc gia.

Tháng 8 năm 2026:DeepSeek đã khởi động vòng gọi vốn thứ hai 50 tỷ nhân dân tệ, định giá trước gọi vốn khoảng 500 tỷ nhân dân tệ (khoảng 74 tỷ đô la).

Tổng định giá của bốn phòng thí nghiệm AI thuần túy lớn của Trung Quốc đã đạt khoảng 159 tỷ đô la, tăng từ gần như bằng không 18 tháng trước.


VI. Dữ liệu thị trường: Các mô hình Trung Quốc thống trị bảng xếp hạng sử dụng toàn cầu

Biểu đồ 4: Thị phần gọi token toàn cầu trên nền tảng OpenRouter (27 tháng 7 – 2 tháng 8)


VII. Đảo ngược và lo ngại

7.1 Khủng hoảng năng lực tính toán, giá sắp tăng

Ngày 6 tháng 8, DeepSeek thông báo sắp "tăng giá API đáng kể." Năng lực tính toán hiện tại của họ chỉ tương đương khoảng 20.000 GPU H100, kém xa các đối thủ Mỹ như OpenAI.

7.2 Rủi ro chính trị

Chính phủ Mỹ rất cảnh giác với việc mô hình của DeepSeek thâm nhập vào cơ sở hạ tầng doanh nghiệp Mỹ. Ngay cả khi triển khai trong trung tâm dữ liệu Azure tại Mỹ của Microsoft, chúng vẫn phải đối mặt với các đánh giá an ninh.

7.3 Nghịch lý thương mại hóa

Tỷ lệ giá trên doanh thu (P/S) của V4-Pro vượt 3.800 lần, gấp hàng chục lần Anthropic, nhưng doanh thu hàng năm của nó cực kỳ thấp. Logic định giá của Liang Wenfeng là "thu hồi chi phí máy chủ trong 10 tháng được coi là lợi nhuận hợp lý," và các nhà đầu tư đối mặt với rủi ro đảo ngược định giá.


VIII. Bình luận của SMM

SMM bình luận về điều này. Thứ nhất,chuẩn mực định giá mô hình lớn toàn cầu đã chuyển từ sự hiểu ngầm giữa ba ông lớn Thung lũng Silicon sang "đường giết chóc" do DeepSeek xác định. Trong khi đó, lộ trình hiệu quả cực đoan của MoE + chú ý thưa + độ chính xác hỗn hợp chứng minh rằng hiệu suất tiên tiến không nhất thiết phải dựa vào việc chồng chất năng lực tính toán. Về phía hệ sinh thái, chip nội địa như Huawei Ascend đã có được cơ hội thực tế quy mô lớn, và rào cản CUDA đang bị lung lay,Cục diện cuối cùng của cuộc cạnh tranh mô hình lớn toàn cầu có thể không thuộc về mô hình mạnh nhất, cũng không phải mô hình rẻ nhất, mà là giải pháp tối ưu trên đường cong hiệu quả chi phí "năng lực/chi phí", đó sẽ là người chiến thắng cuối cùng.


Tài liệu tham khảo

  1. DeepSeek V4 Pro ra mắt với ngữ cảnh 1 triệu token, định hình lại tính toán chi phí của chúng ta — —
  2. AI Wiki
  3. DeepSeek trở thành đường giết chóc AI toàn cầu
  4. DeepSeek-V4-Pro: Mô hình mã nguồn mở đang viết lại các quy tắc của AI
  5. DeepSeek và Zhipu phá vỡ phong tỏa năng lực tính toán: Mô hình Zhipu lọt vào top ba, DeepSeek giảm chi phí xuống còn 1/20
  6. Cách DeepSeek và Alibaba phá vỡ rào cản giá AI: Chênh lệch chi phí 70 lần đang định hình lại cục diện ngành toàn cầu
  7. Sau khi phát hành chính thức DeepSeek-V4-Flash, các nhà sản xuất mô hình hàng đầu như OpenAI đã cắt giảm giá mạnh
  8. Giải thích về cuộc chiến giá suy luận AI
  9. Chi phí suy luận của DeepSeek giảm xuống còn 1/36 của GPT-4o, nó sẽ viết lại các quy tắc ngành như thế nào?
  10. Hạ tầng AI đã trở thành loại hình kinh doanh mà Munger ghét nhất
  11. Microsoft đánh giá sử dụng mô hình DeepSeek V4 để cắt giảm chi phí và tăng hiệu quả, có khả năng thay thế OpenAI và Anthropic
  12. Cuộc chiến giá AI 2026: Tại sao người chiến thắng thực sự không phải DeepSeek hay OpenAI
  13. Google phân bổ Gemini cho Meta: khi năng lực tính toán trở thành tài nguyên hiếm nhất
  14. Microsoft nhắm đến DeepSeek V4 cho Copilot Cowork: Điều mà Azure Hosting không thể khắc phục
  15. Chip nội địa bùng nổ: Điều Nvidia lo sợ nhất đã đến
  16. Cuộc di cư vĩ đại của năng lực tính toán AI: 2026, ba sự chuyển dịch đồng thời
  17. DeepSeek huy động 7,4 tỷ đô la với định giá 50 tỷ đô la trong vòng gọi vốn bên ngoài đầu tiên
  18. Báo cáo: DeepSeek đã khởi động lại vòng gọi vốn thứ hai 50 tỷ nhân dân tệ
  19. Định giá lên tới 500 tỷ nhân dân tệ, DeepSeek đứng đầu bảng xếp hạng cuộc gọi mô hình lớn toàn cầu
  20. Giá rẻ đã hết! DeepSeek sắp tăng giá đáng kể
  21. Triển vọng phát triển trong tương lai của DeepSeek là gì?

Tuyên bố về Nguồn Dữ liệu: Ngoại trừ thông tin công khai, tất cả dữ liệu khác được SMM xử lý dựa trên thông tin công khai, giao tiếp thị trường và dựa trên mô hình cơ sở dữ liệu nội bộ của SMM. Chúng chỉ mang tính chất tham khảo và không cấu thành khuyến nghị ra quyết định.

Hình ảnh trong bài viết này có chú thích được AI dịch, chỉ để tham khảo.

Để biết thêm thông tin hoặc có thắc mắc gì, vui lòng liên hệ: lemonzhao@smm.cn
Để biết thêm thông tin về cách truy cập báo cáo nghiên cứu, vui lòng liên hệ:service.en@smm.cn
Tin Liên Quan
[SMM Điểm tin sức mạnh tính toán giữa trưa] Giá thấp nhất của 4090 tại Đồng bằng sông Dương Tử tăng, sức mạnh thương lượng về sức mạnh tính toán suy luận ở miền Đông Trung Quốc chuyển sang phía cung cấp.
1 giờ trước
[SMM Điểm tin sức mạnh tính toán giữa trưa] Giá thấp nhất của 4090 tại Đồng bằng sông Dương Tử tăng, sức mạnh thương lượng về sức mạnh tính toán suy luận ở miền Đông Trung Quốc chuyển sang phía cung cấp.
Đọc thêm
[SMM Điểm tin sức mạnh tính toán giữa trưa] Giá thấp nhất của 4090 tại Đồng bằng sông Dương Tử tăng, sức mạnh thương lượng về sức mạnh tính toán suy luận ở miền Đông Trung Quốc chuyển sang phía cung cấp.
[SMM Điểm tin sức mạnh tính toán giữa trưa] Giá thấp nhất của 4090 tại Đồng bằng sông Dương Tử tăng, sức mạnh thương lượng về sức mạnh tính toán suy luận ở miền Đông Trung Quốc chuyển sang phía cung cấp.
Tại Đồng bằng sông Dương Tử, giá thuê theo tháng thấp nhất cho card 4090 đã tăng lên 7.200 nhân dân tệ (tăng 4,35%), và giá thuê theo giờ thấp nhất cho mỗi card đã tăng lên 1,25 nhân dân tệ (tăng 4,17%). Là card suy luận AI cấp tiêu dùng chính thống, 4090 chứng kiến nguồn tài nguyên giá rẻ trong khu vực liên tục bị hấp thụ, đẩy giá phân khúc thấp lên và thu hẹp phạm vi báo giá. Quyền thương lượng nghiêng về phía cung, và tình trạng giảm nguồn cung lẻ tẻ chiếm ưu thế.
1 giờ trước
[SMM Tin nhanh Sức mạnh tính toán] Một nhà cung cấp dịch vụ đám mây tính toán thông minh nào đó đang báo giá thuê hàng tháng 7.200 nhân dân tệ/đơn vị/tháng cho máy chủ tám card 4090, cao hơn mức báo giá thấp trước đó.
1 giờ trước
[SMM Tin nhanh Sức mạnh tính toán] Một nhà cung cấp dịch vụ đám mây tính toán thông minh nào đó đang báo giá thuê hàng tháng 7.200 nhân dân tệ/đơn vị/tháng cho máy chủ tám card 4090, cao hơn mức báo giá thấp trước đó.
Đọc thêm
[SMM Tin nhanh Sức mạnh tính toán] Một nhà cung cấp dịch vụ đám mây tính toán thông minh nào đó đang báo giá thuê hàng tháng 7.200 nhân dân tệ/đơn vị/tháng cho máy chủ tám card 4090, cao hơn mức báo giá thấp trước đó.
[SMM Tin nhanh Sức mạnh tính toán] Một nhà cung cấp dịch vụ đám mây tính toán thông minh nào đó đang báo giá thuê hàng tháng 7.200 nhân dân tệ/đơn vị/tháng cho máy chủ tám card 4090, cao hơn mức báo giá thấp trước đó.
SMM được biết một nhà cung cấp dịch vụ điện toán đám mây thông minh gần đây đã hoàn tất việc giao hàng các máy chủ 8 card RTX 4090 với giá giao dịch 7.200 nhân dân tệ cho mỗi đơn vị mỗi tháng. Trước đó, thị trường từng có mức chào giá tương đối thấp là 6.900 nhân dân tệ mỗi đơn vị mỗi tháng. Giá chào ra bên ngoài mới nhất cao hơn khoảng 300 nhân dân tệ so với mức thấp đó, cho thấy dù các mẫu thuộc phân khúc phổ thông có nguồn cung dồi dào, các nhà phân phối vẫn chưa tiếp tục hạ giá chào ra bên ngoài. SMM cho rằng việc giá chào ra bên ngoài của 4090 ổn định phản ánh nhu cầu ở phân khúc năng lực tính toán cấp thấp và trung bình vẫn chưa có dấu hiệu sụt giảm đột ngột.
1 giờ trước
Nhu cầu sức mạnh tính toán AI bùng nổ thúc đẩy hoạt động màng đồng liên tục tăng; Đầu nối tốc độ cao cáp đồng mạnh lên, Taichenguang dẫn đầu mức tăng [Tin nhanh SMM]
1 giờ trước
Nhu cầu sức mạnh tính toán AI bùng nổ thúc đẩy hoạt động màng đồng liên tục tăng; Đầu nối tốc độ cao cáp đồng mạnh lên, Taichenguang dẫn đầu mức tăng [Tin nhanh SMM]
Đọc thêm
Nhu cầu sức mạnh tính toán AI bùng nổ thúc đẩy hoạt động màng đồng liên tục tăng; Đầu nối tốc độ cao cáp đồng mạnh lên, Taichenguang dẫn đầu mức tăng [Tin nhanh SMM]
Nhu cầu sức mạnh tính toán AI bùng nổ thúc đẩy hoạt động màng đồng liên tục tăng; Đầu nối tốc độ cao cáp đồng mạnh lên, Taichenguang dẫn đầu mức tăng [Tin nhanh SMM]
1 giờ trước
[Phân tích SMM] DeepSeek thiết lập "Đường sát thủ", định hình lại quyền định giá mô hình lớn toàn cầu - Shanghai Metals Market (SMM)