I. 행사 개요
2026년 4월 24일, DeepSeek는 V4 시리즈 대형 모델의 프리뷰 버전을 공식 출시했습니다. 여기에는 주력 모델인 DeepSeek-V4-Pro(총 1.6조 파라미터/490억 활성 파라미터)와 경량 모델인 DeepSeek-V4-Flash(총 2,840억 파라미터/130억 활성 파라미터)가 포함됩니다. 두 모델 모두 기본적으로 100만 토큰의 컨텍스트 윈도우를 지원하며 MIT 라이선스로 완전 오픈소스 공개되었습니다. V4 시리즈는 7월 20일 정식 출시되었으며, V4-Flash-0731 정식 버전 API가 7월 31일 공개 테스트를 시작했습니다.
같은 날, DeepSeek는 V4-Pro API에 대해 75% 영구 가격 인하를 발표했습니다. 캐시 적중 시 입력 가격은 100만 토큰당 0.025위안까지 낮아졌고, 출력 가격은 100만 토큰당 6위안으로 전 세계 최첨단 모델 중 최저가를 기록했습니다.
II. 기술 혁신: 단순히 저렴하기만 한 것이 아니다
V4 시리즈는 세 가지 핵심 기술을 도입했습니다:
- 하이브리드 어텐션 아키텍처(CSA + HCA) : 희소 압축 어텐션과 고압축 어텐션을 결합했습니다. 100만 토큰 컨텍스트에서 추론 연산량은 V3.2의 27%에 불과하며, KV 캐시는 10%만 사용합니다.
- 매니폴드 제약 하이퍼커넥션(mHC) : 기존 잔차 연결을 대체하여 수만 개 레이어의 네트워크에서도 훈련 안정성을 보장합니다.
- FP4/FP8 혼합 정밀도 훈련 및 추론 : 업계 최초 구현입니다. VRAM 대역폭 부담을 50% 줄이고 추론 효율을 두 배로 높입니다.
SWE-bench Verified(코딩 능력)에서 V4-Pro는 80.6%를 기록하여 모든 오픈소스 모델을 앞서며 Claude Opus 4.6의 80.8%에 근접했습니다. MMLU-Pro에서 87.5%, AIME 2025 수학 추론에서 85.0%를 기록했습니다. 기술 보고서에서 DeepSeek는 “GPT-5.4 및 Gemini-3.1-Pro에 비해 약 3~6개월 뒤처져 있다”고 인정했지만, 가격 차이를 감안하면 이는 거의 문제되지 않습니다.
III. 가격 대학살: 글로벌 대형 모델의 ‘처형선’
V4-Pro의 가격은 글로벌 대형 모델 가격 체계를 직접적으로 무너뜨렸습니다. 다음은 2026년 7월 주요 모델의 출력 가격 비교입니다(100만 토큰당 미국 달러 기준):
차트 1: 2026년 7월 주요 모델 API 출력 가격 비교 (로그 스케일)

중국 외 개발자 커뮤니티는 다음과 같은 합의에 도달했습니다: 대부분의 C-End 및 중소형 B-End 시나리오에서, 미미한 성능 향상을 위해 추론 비용을 수십 배나 지출하는 것은 상업적으로 타당성이 없습니다. DeepSeek보다 높은 가격을 책정한 모든 경쟁사에게는 두 가지 선택지만 남습니다: 선제적으로 대폭 가격을 인하하거나, 대중 개발자 시장을 완전히 포기하는 것입니다.
차트 2: 핵심 벤치마크 비교 (레이더 차트)

IV. 주요 모델에 미치는 영향
4.1 OpenAI: 오만에서 긴급 가격 인하로
OpenAI가 가장 직접적인 타격을 입었습니다. 2025년 연간 매출은 130억 달러, 총 지출은 340억 달러, 순손실은 390억 달러였으며, 이 중 약 80억 달러가 영업 손실이었습니다.
2026년 7월 30일, GPT-5.6 출시 불과 3주 만에 OpenAI는 Luna 버전에 대해 80% 가격 인하를 긴급 발표했습니다. 샘 알트먼 CEO는 비용이 "업계 최대 과제"임을 공개적으로 인정하며, "OpenAI는 기꺼이 75% 가격을 인하할 것"이라고 밝혔으며, 이는 DeepSeek에 대한 수동적 대응으로 해석되었습니다.
OpenRouter 플랫폼에서 중국 모델의 주간 토큰 소비량이 60%를 넘어선 반면, 미국 모델은 20% 미만으로 떨어졌습니다[9]. 미국 클라우드 플랫폼 Vercel의 데이터에 따르면, 기업 시장에서 DeepSeek 모델의 사용 점유율이 4월 1%에서 5월 17%로 급증했습니다.
4.2 Anthropic: 고가 전략, 압박 직면
Claude Fable 5의 가격은 출력 토큰 100만 개당 50달러로, V4-Pro의 57배에 달합니다. 2026년 6월, Anthropic은 중국 외 사용자의 Claude 사용을 차단하기 시작하며 시장을 선제적으로 축소했습니다. 이는 지나치게 높은 컴퓨팅 비용으로 인해 고ARPU 시장에 집중할 수밖에 없는 조치로 해석됩니다.
4.3 Google: 컴퓨팅 파워 부족
Google Cloud의 수주 잔고가 4,600억 달러에 달했으며, Gemini는 메타(Meta) 등 주요 고객에 대해 사용량 할당제를 시행하기 시작했습니다.
4.4 Microsoft: 이탈 조짐
2026년 6월 16일, 마이크로소프트는 Copilot Cowork에 DeepSeek V4를 통합하여 OpenAI 및 Anthropic 모델을 대체하는 방안을 공식 평가하기 시작했습니다. 사티아 나델라 CEO는 "더 저렴한 모델과 폭넓은 선택지는 AI에 대한 사회의 신뢰를 높일 것입니다. 대중은 소수 모델과 기업이 모든 학습을 독점하는 것을 용납하지 않을 것입니다."라고 공개 발언했습니다. 마이크로소프트가 OpenAI 지분 27%를 보유한 것을 감안하면, 이 발언은 업계를 뒤흔들었습니다.
4.5 Nvidia: CUDA 해자에 균열
DeepSeek V4 출시 당일, 화웨이 어센드, 캠브리콘, 하이곤, 무어 스레드, 무시(Muxi), 쿤룬 코어, 알리바바 T-Head(티헤드), 톈지 등 8개 중국 주요 GPU 제조사에 완벽하게 적응했습니다. 번스타인은 2026년 중국 AI 가속기 시장에서 Nvidia 점유율이 95%에서 약 8%로 하락하고, 화웨이 어센드는 50%~62%로 상승할 것으로 전망합니다.
차트 3: 2026년 대형 모델 가격 전쟁 주요 이벤트 타임라인

V. 자본 광풍: 5,000억 위안 기업가치
2026년 6월: 500억 위안(약 74억 달러)을 초과하는 첫 번째 외부 자금 조달을 완료했으며, 기업가치는 500억 달러를 넘었습니다. 투자자로는 량원펑 개인이 200억 위안, 텐센트 100억 위안, CATL 50억 위안, JD.com 30억 위안, 그리고 국가 AI 산업 투자 펀드가 참여했습니다.
2026년 8월: 500억 위안 규모의 두 번째 자금 조달을 시작했으며, 투자 전 기업가치는 약 5,000억 위안(약 740억 달러)에 달했습니다.
중국 4대 순수 AI 연구소의 총 기업가치는 약 1,590억 달러에 이르렀으며, 18개월 전만 해도 거의 0에 가까웠습니다.
VI. 시장 데이터: 중국 모델, 글로벌 사용량 순위 석권
차트 4: OpenRouter 플랫폼 글로벌 토큰 호출 점유율 (7월 27일 ~ 8월 2일)

VII. 반전과 우려
7.1 컴퓨팅 파워 부족, 가격 인상 임박
8월 6일, DeepSeek은 API 가격을 "대폭 인상"할 것이라고 발표했습니다. 현재 보유한 컴퓨팅 파워는 약 2만 개의 H100 GPU에 불과해 OpenAI 등 미국 경쟁사에 크게 뒤처집니다.
7.2 정치적 리스크
미국 정부는 DeepSeek 모델이 미국 기업 인프라에 진입하는 것을 매우 경계하고 있습니다. 마이크로소프트의 미국 Azure 데이터센터에 배포되더라도 여전히 보안 검토 대상입니다.
7.3 상업화의 역설
V4-Pro의 P/S 비율(주가매출비율)은 3,800배를 넘어 Anthropic의 수십 배에 달하지만, 연간 환산 매출은 극히 낮습니다. 량원펑의 가격 논리는 "서버 비용을 10개월 내에 회수하면 합리적인 이익으로 간주한다"는 것이었으며, 투자자들은 기업가치 역전 위험에 직면해 있습니다.
VIII. SMM 논평
SMM은 이에 대해 다음과 같이 논평했습니다. 첫째, 글로벌 대형 모델 가격 기준이 실리콘밸리 3대 거대 기업 간의 암묵적 합의에서 DeepSeek이 정의한 '킬링 라인'으로 이동했습니다. 또한, MoE + 희소 어텐션 + 혼합 정밀도의 극한 효율 노선은 최첨단 성능이 반드시 컴퓨팅 파워 투입에 의존할 필요가 없음을 보여줍니다. 생태계 측면에서는 화웨이 어센드 등 국산 칩이 대규모 실전 기회를 얻었으며, CUDA 장벽이 흔들리고 있습니다. 글로벌 대형 모델 경쟁의 최종 승자는 가장 강력한 모델도, 가장 저렴한 모델도 아닌, '성능/비용' 가성비 곡선상의 최적 솔루션이 될 가능성이 높습니다. 바로 그것이 궁극의 승자가 될 것입니다.
참고문헌
- DeepSeek V4 Pro, 100만 토큰 컨텍스트로 출시, 비용 계산법 재편 — —
- AI Wiki —
- DeepSeek, 글로벌 AI 킬링 라인으로 부상 —
- DeepSeek-V4-Pro: AI의 규칙을 다시 쓰는 오픈소스 모델 —
- DeepSeek과 즈푸(Zhipu), 컴퓨팅 파워 봉쇄 돌파: 즈푸 모델 3위권 진입, DeepSeek 비용 1/20로 절감 —
- DeepSeek과 알리바바, AI 가격 장벽을 허물다: 70배 비용 격차가 글로벌 산업 지형 재편 —
- DeepSeek-V4-Flash 공식 출시 후 OpenAI 등 주요 모델 제조사 가격 인하 —
- AI 추론 가격 전쟁 해설 —
- DeepSeek 추론 비용, GPT-4o의 1/36로 하락, 산업 규칙을 어떻게 다시 쓸 것인가? —
- AI 인프라, 멍거가 가장 싫어하는 사업이 되다 —
- 마이크로소프트, 비용 절감 및 효율 향상 위해 DeepSeek V4 모델 사용 검토, OpenAI 및 Anthropic 대체 가능성 —
- 2026년 AI 가격 전쟁: 진정한 승자가 DeepSeek이나 OpenAI가 아닌 이유 —
- Google, 메타를 위해 Gemini 할당: 컴퓨팅이 가장 희귀한 자원이 될 때 —
- 마이크로소프트, Copilot Cowork에 DeepSeek V4 검토: Azure 호스팅으로 해결할 수 없는 것 —
- 국산 칩 붐: Nvidia가 가장 두려워한 일이 현실로 —
- AI 컴퓨팅 파워 대이동: 2026년, 동시다발적 세 가지 변화 —
- DeepSeek, 첫 외부 자금 조달 라운드에서 500억 달러 기업가치로 74억 달러 조달 —
- 보도: DeepSeek, 500억 위안 규모 두 번째 자금 조달 재개 —
- 기업가치 최고 5,000억 위안, DeepSeek 글로벌 대형 모델 호출 순위 1위 —
- 저가 시대 끝! DeepSeek, 대폭 가격 인상 예정 —
- DeepSeek의 향후 발전 전망은? —
![[SMM Computing Power Midday Review] The lowest price of the 4090 in the Yangtze River Delta rises, and bargaining power for inference computing power in east China shifts to the supply side.](https://imgqn.smm.cn/usercenter/ipCjz20251217171734.jpeg)
![[SMM 컴퓨팅 파워 익스프레스] 한 지능형 컴퓨팅 클라우드 서비스 제공업체가 4090 8카드 서버의 월 임대료를 대당 7,200위안으로 견적했으며, 이는 이전 최저 견적보다 높은 수준입니다.](https://imgqn.smm.cn/usercenter/SSKOK20251217171734.jpeg)
![AI 컴퓨팅 파워 수요 급증이 동박 사업의 지속적 상승을 견인; 구리 케이블 고속 커넥터 강세, 타이첸광이 상승 주도 [SMM 익스프레스]](https://imgqn.smm.cn/usercenter/tXxfd20251217171713.jpg)
