I. Обзор событий
24 апреля 2026 года DeepSeek официально представила предварительную версию больших моделей серии V4, включая флагманскую DeepSeek-V4-Pro (1,6 триллиона общих параметров / 49 миллиардов активных параметров) и облегчённую DeepSeek-V4-Flash (284 миллиарда общих параметров / 13 миллиардов активных параметров). Обе изначально поддерживают контекстное окно в 1 миллион токенов и полностью открыты под лицензией MIT. Серия V4 стала официально доступна 20 июля, а публичное тестирование API официальной версии V4-Flash-0731 началось 31 июля.
В тот же день DeepSeek объявила о бессрочном снижении цены на API V4-Pro на 75%. В сценариях попадания в кэш цена ввода упала до 0,025 юаня за миллион токенов, а вывода — до 6 юаней за миллион токенов, что стало новым минимумом среди передовых мировых моделей.
II. Технологические прорывы: не только о дешевизне
В серии V4 внедрены три ключевые технологии:
- Гибридная архитектура внимания (CSA + HCA) : Сочетает сжатое разреженное внимание и сильно сжатое внимание. При контексте в 1 миллион токенов вычислительные затраты на инференс составляют лишь 27% от V3.2, а кэш KV занимает всего 10%.
- Ограниченная многообразием гиперсвязь (mHC) : Заменяет традиционные остаточные связи, обеспечивая стабильность обучения сетей с десятками тысяч слоёв.
- Смешанное обучение и инференс с точностью FP4/FP8 : Впервые реализовано в индустрии. Снижает нагрузку на пропускную способность видеопамяти на 50% и удваивает эффективность инференса.
На SWE-bench Verified (способности к программированию) V4-Pro набрала 80,6%, лидируя среди всех открытых моделей и почти сравнявшись с 80,8% у Claude Opus 4.6. Модель получила 87,5% на MMLU-Pro и 85,0% на математическом рассуждении AIME 2025. В своём техническом отчёте DeepSeek признала, что «немного отстаёт от GPT-5.4 и Gemini-3.1-Pro примерно на 3–6 месяцев», но с учётом разницы в цене это почти не имеет значения.
III. Ценовая бойня: «рубеж казни» для глобальных крупных моделей
Ценообразование V4-Pro напрямую разрушило глобальную систему цен на большие модели. Ниже приведено сравнение цен на вывод для основных моделей в июле 2026 года (в долларах США за миллион токенов):
График 1: Сравнение цен на вывод API основных моделей в июле 2026 г. (логарифмическая шкала)

Сообщество разработчиков за пределами Китая пришло к консенсусу: Для подавляющего большинства сценариев в сегментах «бизнес-клиент–конечный пользователь» и малого и среднего бизнеса нести расходы на логический вывод, в десятки раз превышающие затраты ради незначительного прироста производительности, коммерчески нецелесообразно. Перед любым конкурентом, чьи цены выше, чем у DeepSeek, остаются лишь два пути: либо значительно снизить цены в инициативном порядке, либо полностью отказаться от массового рынка разработчиков.
График 2: Сравнение ключевых бенчмарков (лепестковая диаграмма)

IV. Влияние на основные модели
4.1 OpenAI: от высокомерия к срочному снижению цен
OpenAI пострадала напрямую сильнее всего. В 2025 году годовая выручка компании составила 13 млрд долларов, общие расходы — 34 млрд долларов, чистый убыток — 39 млрд долларов, из которых около 8 млрд долларов пришлось на операционные убытки.
30 июля 2026 года, всего через три недели после выпуска GPT-5.6, OpenAI экстренно объявила о снижении цены на версию Luna на 80%. Генеральный директор Сэм Альтман публично признал, что стоимость является «самой большой проблемой в отрасли», и заявил, что «OpenAI с радостью снизит цены на 75%», что наблюдатели расценили как пассивный ответ DeepSeek.
На платформе OpenRouter недельное потребление токенов китайскими моделями превысило 60%, тогда как доля американских моделей упала ниже 20% [9]. Данные американской облачной платформы Vercel показывают, что доля использования моделей DeepSeek на корпоративном рынке резко возросла с 1% в апреле до 17% в мае.
4.2 Anthropic: стратегия высоких цен под давлением
Стоимость вывода Claude Fable 5 составляет 50 долларов за миллион токенов, что в 57 раз выше, чем у V4-Pro. В июне 2026 года Anthropic начала запрещать пользователям из-за пределов Китая использовать Claude, проактивно сократив свой рынок, что трактуется как вынужденный высокими затратами на вычисления ход с фокусом на рынки с высоким средним доходом на пользователя.
4.3 Google: нехватка вычислительных мощностей
Портфель заказов Google Cloud достиг 460 млрд долларов, и Gemini начала вводить квоты на использование для крупных клиентов, таких как Meta.
4.4 Microsoft: сигналы «отступничества»
16 июня 2026 года Microsoft официально начала оценку интеграции DeepSeek V4 в Copilot Cowork для замены моделей OpenAI и Anthropic. Генеральный директор Сатья Наделла публично заявил: «Более дешёвые модели и более широкий выбор повысят доверие общества к ИИ; общественность не потерпит монополизации всего процесса обучения несколькими моделями и компаниями». Учитывая 27-процентную долю Microsoft в OpenAI, это заявление потрясло отрасль.
4.5 Nvidia: трещина в крепостном рве CUDA
В день выпуска DeepSeek V4 была достигнута полная адаптация с восемью ведущими китайскими производителями GPU: Huawei Ascend, Cambricon, Hygon, Moore Threads, Muxi, Kunlun Core, Alibaba T-Head и Tianjic. Bernstein прогнозирует, что доля Nvidia на рынке ускорителей ИИ в Китае упадёт с 95% в 2026 году примерно до 8%, в то время как доля Huawei Ascend вырастет до 50–62%.
График 3: Хронология ключевых событий ценовой войны на рынке больших моделей в 2026 году

V. Капитальный ажиотаж: оценка в 500 млрд
В июне 2026 года: завершился первый раунд внешнего финансирования на сумму более 50 млрд юаней, оценка превысила 50 млрд долларов. В число инвесторов вошли личные средства Лян Вэньфэна в размере 20 млрд юаней, 10 млрд юаней от Tencent, 5 млрд юаней от CATL, 3 млрд юаней от JD.com и Государственный инвестиционный фонд индустрии ИИ.
Август 2026 года: Объявлен второй раунд финансирования на 50 млрд юаней, предварительная оценка составила около 500 млрд юаней (около 74 млрд долларов).
Совокупная оценка четырёх крупнейших чистых лабораторий ИИ в Китае достигла примерно 159 млрд долларов, тогда как 18 месяцев назад она была близка к нулю.
VI. Рыночные данные: китайские модели доминируют в глобальных рейтингах использования
График 4: Глобальная доля вызовов токенов на платформе OpenRouter (27 июля – 2 августа)

VII. Развороты и опасения
7.1 Дефицит вычислительных мощностей и предстоящее повышение цен
6 августа DeepSeek объявила о скором «значительном повышении цен API». Её текущие вычислительные мощности эквивалентны лишь примерно 20 000 GPU H100, что значительно уступает американским конкурентам, таким как OpenAI.
7.2 Политические риски
Американское правительство с большой насторожённостью относится к проникновению моделей DeepSeek в корпоративную инфраструктуру США. Даже при развёртывании в американских дата-центрах Microsoft Azure они всё равно сталкиваются с проверками безопасности.
7.3 Парадокс коммерциализации
Соотношение цены к объёму продаж (P/S) для V4-Pro превысило 3800 раз, что в десятки раз больше, чем у Anthropic, однако её годовая выручка крайне низка. Логика ценообразования Лян Вэньфэна заключалась в том, что «возврат стоимости сервера за 10 месяцев считается разумной прибылью», и инвесторы сталкиваются с риском разворота оценки.
VIII. Комментарий SMM
SMM прокомментировала это. Во-первых,глобальный ориентир ценообразования на большие модели сместился с молчаливого взаимопонимания между тремя олигополистами Кремниевой долины к «линии отсечения», определяемой DeepSeek. При этом маршрут экстремальной эффективности «смесь экспертов + разреженное внимание + смешанная точность» демонстрирует, что передовая производительность не обязательно должна опираться на наращивание вычислительных мощностей. Что касается экосистемы, отечественные чипы, такие как Huawei Ascend, получили широкие практические возможности, и барьер CUDA расшатывается,Финал глобальной конкуренции больших моделей, возможно, выиграет не самая сильная модель и не самая дешёвая, а оптимальное решение на кривой «возможности/стоимость» по соотношению цена–производительность, которое и станет окончательным победителем.
Ссылки
- DeepSeek V4 Pro Arrives With 1M-Token Context, Reshaping Our Cost Calculus — —
- AI Wiki —
- DeepSeek Becomes the Global AI Killing Line —
- DeepSeek-V4-Pro: The Open-Source Model That's Rewriting the Rules of AI —
- DeepSeek и Zhipu совершают прорыв сквозь блокаду вычислительных мощностей: модель Zhipu входит в тройку лидеров, DeepSeek снижает стоимость до 1/20 —
- How DeepSeek and Alibaba Are Shattering AI Price Barriers: A 70x Cost Differential Is Reshaping the Global Industry Landscape —
- После официального релиза DeepSeek-V4-Flash ведущие разработчики моделей, такие как OpenAI, резко снизили цены —
- AI Inference Price War Explained —
- Стоимость логического вывода DeepSeek снизилась до 1/36 от GPT-4o — как это изменит правила игры в отрасли? —
- AI Infrastructure Has Become the Kind of Business Munger Hates Most —
- Microsoft оценивает использование модели DeepSeek V4 для снижения затрат и повышения эффективности, с возможной заменой OpenAI и Anthropic —
- AI Price War 2026: Why the Real Winner Isn't DeepSeek or OpenAI —
- Google rations Gemini for Meta: when compute becomes the rarest resource —
- Microsoft Eyes DeepSeek V4 for Copilot Cowork: What Azure Hosting Cannot Fix —
- Бум отечественных чипов: случилось то, чего Nvidia боится больше всего —
- The Great Migration of AI Computing Power: 2026, Three Simultaneous Shifts —
- DeepSeek привлекает 7,4 млрд долларов при оценке в 50 млрд в первом внешнем раунде финансирования —
- Отчёты: DeepSeek вновь запустила второй раунд финансирования на 50 млрд юаней —
- Оценка достигает 500 млрд юаней, DeepSeek возглавляет мировой рейтинг вызовов больших моделей —
- Эпоха низких цен закончилась! DeepSeek готовится значительно повысить цены — \
- Каковы перспективы дальнейшего развития DeepSeek? —
![[SMM Полуденный обзор рынка вычислительных мощностей] Минимальная цена на 4090 в дельте Янцзы растёт, и рыночная сила в сфере вычислительных мощностей для инференса в Восточном Китае смещается в пользу поставщиков.](https://imgqn.smm.cn/usercenter/ipCjz20251217171734.jpeg)
![[SMM Computing Power Express] Некий провайдер облачных услуг для интеллектуальных вычислений предлагает ежемесячную аренду серверов с восемью картами 4090 по цене 7 200 юаней за единицу в месяц, что выше предыдущего низкого предложения.](https://imgqn.smm.cn/usercenter/SSKOK20251217171734.jpeg)
![Бум спроса на вычислительные мощности ИИ способствует непрерывному росту производства медной фольги; высокоскоростные медные кабельные соединители укрепляются, Taichenguang лидирует по росту [SMM Express]](https://imgqn.smm.cn/usercenter/tXxfd20251217171713.jpg)
