[SMM Analysis] DeepSeek устанавливает «линию отсечки», перераспределяя глобальное влияние на ценообразование крупных моделей

Опубликовано: Aug 11, 2026 13:12
DeepSeek V4 Pro своим сверхнизким ценообразованием спровоцировал глобальную ценовую войну среди крупных языковых моделей. OpenAI снизила цены на 80 %, Anthropic свернула деятельность за пределами Китая, Microsoft рассматривает возможность интеграции, а доля Nvidia на китайском рынке GPU упала с 95 % до 8 %. Китайские модели обеспечили 60 % общего объёма запросов на OpenRouter, опережая американские модели 14 недель подряд.

I. Обзор событий

24 апреля 2026 года DeepSeek официально представила предварительную версию больших моделей серии V4, включая флагманскую DeepSeek-V4-Pro (1,6 триллиона общих параметров / 49 миллиардов активных параметров) и облегчённую DeepSeek-V4-Flash (284 миллиарда общих параметров / 13 миллиардов активных параметров). Обе изначально поддерживают контекстное окно в 1 миллион токенов и полностью открыты под лицензией MIT. Серия V4 стала официально доступна 20 июля, а публичное тестирование API официальной версии V4-Flash-0731 началось 31 июля.

В тот же день DeepSeek объявила о бессрочном снижении цены на API V4-Pro на 75%. В сценариях попадания в кэш цена ввода упала до 0,025 юаня за миллион токенов, а вывода — до 6 юаней за миллион токенов, что стало новым минимумом среди передовых мировых моделей.


II. Технологические прорывы: не только о дешевизне

В серии V4 внедрены три ключевые технологии:

  1. Гибридная архитектура внимания (CSA + HCA) : Сочетает сжатое разреженное внимание и сильно сжатое внимание. При контексте в 1 миллион токенов вычислительные затраты на инференс составляют лишь 27% от V3.2, а кэш KV занимает всего 10%.
  2. Ограниченная многообразием гиперсвязь (mHC) : Заменяет традиционные остаточные связи, обеспечивая стабильность обучения сетей с десятками тысяч слоёв.
  3. Смешанное обучение и инференс с точностью FP4/FP8 : Впервые реализовано в индустрии. Снижает нагрузку на пропускную способность видеопамяти на 50% и удваивает эффективность инференса.

На SWE-bench Verified (способности к программированию) V4-Pro набрала 80,6%, лидируя среди всех открытых моделей и почти сравнявшись с 80,8% у Claude Opus 4.6. Модель получила 87,5% на MMLU-Pro и 85,0% на математическом рассуждении AIME 2025. В своём техническом отчёте DeepSeek признала, что «немного отстаёт от GPT-5.4 и Gemini-3.1-Pro примерно на 3–6 месяцев», но с учётом разницы в цене это почти не имеет значения.


III. Ценовая бойня: «рубеж казни» для глобальных крупных моделей

Ценообразование V4-Pro напрямую разрушило глобальную систему цен на большие модели. Ниже приведено сравнение цен на вывод для основных моделей в июле 2026 года (в долларах США за миллион токенов):

График 1: Сравнение цен на вывод API основных моделей в июле 2026 г. (логарифмическая шкала)

Сообщество разработчиков за пределами Китая пришло к консенсусу: Для подавляющего большинства сценариев в сегментах «бизнес-клиент–конечный пользователь» и малого и среднего бизнеса нести расходы на логический вывод, в десятки раз превышающие затраты ради незначительного прироста производительности, коммерчески нецелесообразно. Перед любым конкурентом, чьи цены выше, чем у DeepSeek, остаются лишь два пути: либо значительно снизить цены в инициативном порядке, либо полностью отказаться от массового рынка разработчиков.

График 2: Сравнение ключевых бенчмарков (лепестковая диаграмма)


IV. Влияние на основные модели

4.1 OpenAI: от высокомерия к срочному снижению цен

OpenAI пострадала напрямую сильнее всего. В 2025 году годовая выручка компании составила 13 млрд долларов, общие расходы — 34 млрд долларов, чистый убыток — 39 млрд долларов, из которых около 8 млрд долларов пришлось на операционные убытки.

30 июля 2026 года, всего через три недели после выпуска GPT-5.6, OpenAI экстренно объявила о снижении цены на версию Luna на 80%. Генеральный директор Сэм Альтман публично признал, что стоимость является «самой большой проблемой в отрасли», и заявил, что «OpenAI с радостью снизит цены на 75%», что наблюдатели расценили как пассивный ответ DeepSeek.

На платформе OpenRouter недельное потребление токенов китайскими моделями превысило 60%, тогда как доля американских моделей упала ниже 20% [9]. Данные американской облачной платформы Vercel показывают, что доля использования моделей DeepSeek на корпоративном рынке резко возросла с 1% в апреле до 17% в мае.

4.2 Anthropic: стратегия высоких цен под давлением

Стоимость вывода Claude Fable 5 составляет 50 долларов за миллион токенов, что в 57 раз выше, чем у V4-Pro. В июне 2026 года Anthropic начала запрещать пользователям из-за пределов Китая использовать Claude, проактивно сократив свой рынок, что трактуется как вынужденный высокими затратами на вычисления ход с фокусом на рынки с высоким средним доходом на пользователя.

4.3 Google: нехватка вычислительных мощностей

Портфель заказов Google Cloud достиг 460 млрд долларов, и Gemini начала вводить квоты на использование для крупных клиентов, таких как Meta.

4.4 Microsoft: сигналы «отступничества»

16 июня 2026 года Microsoft официально начала оценку интеграции DeepSeek V4 в Copilot Cowork для замены моделей OpenAI и Anthropic. Генеральный директор Сатья Наделла публично заявил: «Более дешёвые модели и более широкий выбор повысят доверие общества к ИИ; общественность не потерпит монополизации всего процесса обучения несколькими моделями и компаниями». Учитывая 27-процентную долю Microsoft в OpenAI, это заявление потрясло отрасль.

4.5 Nvidia: трещина в крепостном рве CUDA

В день выпуска DeepSeek V4 была достигнута полная адаптация с восемью ведущими китайскими производителями GPU: Huawei Ascend, Cambricon, Hygon, Moore Threads, Muxi, Kunlun Core, Alibaba T-Head и Tianjic. Bernstein прогнозирует, что доля Nvidia на рынке ускорителей ИИ в Китае упадёт с 95% в 2026 году примерно до 8%, в то время как доля Huawei Ascend вырастет до 50–62%.

График 3: Хронология ключевых событий ценовой войны на рынке больших моделей в 2026 году


V. Капитальный ажиотаж: оценка в 500 млрд

В июне 2026 года: завершился первый раунд внешнего финансирования на сумму более 50 млрд юаней, оценка превысила 50 млрд долларов. В число инвесторов вошли личные средства Лян Вэньфэна в размере 20 млрд юаней, 10 млрд юаней от Tencent, 5 млрд юаней от CATL, 3 млрд юаней от JD.com и Государственный инвестиционный фонд индустрии ИИ.

Август 2026 года: Объявлен второй раунд финансирования на 50 млрд юаней, предварительная оценка составила около 500 млрд юаней (около 74 млрд долларов).

Совокупная оценка четырёх крупнейших чистых лабораторий ИИ в Китае достигла примерно 159 млрд долларов, тогда как 18 месяцев назад она была близка к нулю.


VI. Рыночные данные: китайские модели доминируют в глобальных рейтингах использования

График 4: Глобальная доля вызовов токенов на платформе OpenRouter (27 июля – 2 августа)


VII. Развороты и опасения

7.1 Дефицит вычислительных мощностей и предстоящее повышение цен

6 августа DeepSeek объявила о скором «значительном повышении цен API». Её текущие вычислительные мощности эквивалентны лишь примерно 20 000 GPU H100, что значительно уступает американским конкурентам, таким как OpenAI.

7.2 Политические риски

Американское правительство с большой насторожённостью относится к проникновению моделей DeepSeek в корпоративную инфраструктуру США. Даже при развёртывании в американских дата-центрах Microsoft Azure они всё равно сталкиваются с проверками безопасности.

7.3 Парадокс коммерциализации

Соотношение цены к объёму продаж (P/S) для V4-Pro превысило 3800 раз, что в десятки раз больше, чем у Anthropic, однако её годовая выручка крайне низка. Логика ценообразования Лян Вэньфэна заключалась в том, что «возврат стоимости сервера за 10 месяцев считается разумной прибылью», и инвесторы сталкиваются с риском разворота оценки.


VIII. Комментарий SMM

SMM прокомментировала это. Во-первых,глобальный ориентир ценообразования на большие модели сместился с молчаливого взаимопонимания между тремя олигополистами Кремниевой долины к «линии отсечения», определяемой DeepSeek. При этом маршрут экстремальной эффективности «смесь экспертов + разреженное внимание + смешанная точность» демонстрирует, что передовая производительность не обязательно должна опираться на наращивание вычислительных мощностей. Что касается экосистемы, отечественные чипы, такие как Huawei Ascend, получили широкие практические возможности, и барьер CUDA расшатывается,Финал глобальной конкуренции больших моделей, возможно, выиграет не самая сильная модель и не самая дешёвая, а оптимальное решение на кривой «возможности/стоимость» по соотношению цена–производительность, которое и станет окончательным победителем.


Ссылки

  1. DeepSeek V4 Pro Arrives With 1M-Token Context, Reshaping Our Cost Calculus — —
  2. AI Wiki
  3. DeepSeek Becomes the Global AI Killing Line
  4. DeepSeek-V4-Pro: The Open-Source Model That's Rewriting the Rules of AI
  5. DeepSeek и Zhipu совершают прорыв сквозь блокаду вычислительных мощностей: модель Zhipu входит в тройку лидеров, DeepSeek снижает стоимость до 1/20
  6. How DeepSeek and Alibaba Are Shattering AI Price Barriers: A 70x Cost Differential Is Reshaping the Global Industry Landscape
  7. После официального релиза DeepSeek-V4-Flash ведущие разработчики моделей, такие как OpenAI, резко снизили цены
  8. AI Inference Price War Explained
  9. Стоимость логического вывода DeepSeek снизилась до 1/36 от GPT-4o — как это изменит правила игры в отрасли?
  10. AI Infrastructure Has Become the Kind of Business Munger Hates Most
  11. Microsoft оценивает использование модели DeepSeek V4 для снижения затрат и повышения эффективности, с возможной заменой OpenAI и Anthropic
  12. AI Price War 2026: Why the Real Winner Isn't DeepSeek or OpenAI
  13. Google rations Gemini for Meta: when compute becomes the rarest resource
  14. Microsoft Eyes DeepSeek V4 for Copilot Cowork: What Azure Hosting Cannot Fix
  15. Бум отечественных чипов: случилось то, чего Nvidia боится больше всего
  16. The Great Migration of AI Computing Power: 2026, Three Simultaneous Shifts
  17. DeepSeek привлекает 7,4 млрд долларов при оценке в 50 млрд в первом внешнем раунде финансирования
  18. Отчёты: DeepSeek вновь запустила второй раунд финансирования на 50 млрд юаней
  19. Оценка достигает 500 млрд юаней, DeepSeek возглавляет мировой рейтинг вызовов больших моделей
  20. Эпоха низких цен закончилась! DeepSeek готовится значительно повысить цены — \
  21. Каковы перспективы дальнейшего развития DeepSeek?

Заявление об источниках данных: За исключением общедоступной информации, все остальные данные обрабатываются SMM на основе общедоступной информации, рыночного общения и с опорой на внутреннюю базу данных и модели SMM. Они приведены только для справки и не являются рекомендациями для принятия решений.

Изображения в этой статье содержат подписи, переведенные ИИ, только для справки.

По любым вопросам или для получения дополнительной информации, пожалуйста, свяжитесь: lemonzhao@smm.cn
Для получения дополнительной информации о доступе к нашим исследовательским отчётам обращайтесь:service.en@smm.cn
Связанные новости
[SMM Полуденный обзор рынка вычислительных мощностей] Минимальная цена на 4090 в дельте Янцзы растёт, и рыночная сила в сфере вычислительных мощностей для инференса в Восточном Китае смещается в пользу поставщиков.
1 час назад
[SMM Полуденный обзор рынка вычислительных мощностей] Минимальная цена на 4090 в дельте Янцзы растёт, и рыночная сила в сфере вычислительных мощностей для инференса в Восточном Китае смещается в пользу поставщиков.
Читать далее
[SMM Полуденный обзор рынка вычислительных мощностей] Минимальная цена на 4090 в дельте Янцзы растёт, и рыночная сила в сфере вычислительных мощностей для инференса в Восточном Китае смещается в пользу поставщиков.
[SMM Полуденный обзор рынка вычислительных мощностей] Минимальная цена на 4090 в дельте Янцзы растёт, и рыночная сила в сфере вычислительных мощностей для инференса в Восточном Китае смещается в пользу поставщиков.
В дельте реки Янцзы минимальная месячная стоимость аренды 4090 выросла до 7 200 юаней (рост на 4,35%), а минимальная почасовая ставка за карту — до 1,25 юаня (рост на 4,17%). Являясь основной потребительской картой для инференса ИИ, 4090 столкнулась с постоянным поглощением бюджетных ресурсов в регионе, что подтолкнуло вверх цены нижнего сегмента и сузило диапазон котировок. Переговорные позиции сместились в пользу поставщиков, и доминировали спорадические сокращения предложения.
1 час назад
[SMM Computing Power Express] Некий провайдер облачных услуг для интеллектуальных вычислений предлагает ежемесячную аренду серверов с восемью картами 4090 по цене 7 200 юаней за единицу в месяц, что выше предыдущего низкого предложения.
1 час назад
[SMM Computing Power Express] Некий провайдер облачных услуг для интеллектуальных вычислений предлагает ежемесячную аренду серверов с восемью картами 4090 по цене 7 200 юаней за единицу в месяц, что выше предыдущего низкого предложения.
Читать далее
[SMM Computing Power Express] Некий провайдер облачных услуг для интеллектуальных вычислений предлагает ежемесячную аренду серверов с восемью картами 4090 по цене 7 200 юаней за единицу в месяц, что выше предыдущего низкого предложения.
[SMM Computing Power Express] Некий провайдер облачных услуг для интеллектуальных вычислений предлагает ежемесячную аренду серверов с восемью картами 4090 по цене 7 200 юаней за единицу в месяц, что выше предыдущего низкого предложения.
SMM стало известно, что один провайдер интеллектуальных облачных вычислений недавно завершил поставки серверов с 8 картами RTX 4090 по цене сделки 7 200 юаней за единицу в месяц. Ранее на рынке наблюдалась относительно низкая котировка в 6 900 юаней за единицу в месяц. Последняя внешняя цена примерно на 300 юаней выше этого минимума, что указывает на то, что, несмотря на достаточное предложение моделей начального уровня, дистрибьюторы не продолжили снижать внешние котировки. SMM полагает, что стабилизация внешних котировок на 4090 отражает тот факт, что спрос в сегменте вычислительных мощностей низкого и среднего уровня еще не испытал обвального сокращения.
1 час назад
Бум спроса на вычислительные мощности ИИ способствует непрерывному росту производства медной фольги; высокоскоростные медные кабельные соединители укрепляются, Taichenguang лидирует по росту [SMM Express]
1 час назад
Бум спроса на вычислительные мощности ИИ способствует непрерывному росту производства медной фольги; высокоскоростные медные кабельные соединители укрепляются, Taichenguang лидирует по росту [SMM Express]
Читать далее
Бум спроса на вычислительные мощности ИИ способствует непрерывному росту производства медной фольги; высокоскоростные медные кабельные соединители укрепляются, Taichenguang лидирует по росту [SMM Express]
Бум спроса на вычислительные мощности ИИ способствует непрерывному росту производства медной фольги; высокоскоростные медные кабельные соединители укрепляются, Taichenguang лидирует по росту [SMM Express]
1 час назад
Связанные новости