В России зафиксирован почти трехкратный рост стоимости внедрения ИИ
Летом 2026 года стоимость развертывания ведущих больших языковых моделей в России достигла в среднем 38,8 млн рублей, тогда как в 2025 году она составляла 13,7 млн рублей. Такие данные представили аналитики MWS Cloud.
«Цены на GPU в России во многом зависят от мирового рынка: глобальная гонка в ИИ-области увеличивает спрос на вычислительные мощности и поддерживает рост стоимости ускорителей. По данным исследования MWS Cloud, 47% респондентов ожидают удорожания GPU-ресурсов до осени 2027 г., а 45% считают, что их значение для бизнеса будет расти. Развертывать крупные ИИ-модели на собственной ИТ-инфраструктуре становится дороже, однако единого ценового предела, после которого рынок потеряет интерес к ИИ-технологиям, нет», — отметил генеральный директор MWS Павел Воронин.
В августе 2026 года аналитики MWS Cloud проанализировали требования к вычислительной инфраструктуре для запуска ведущих мировых и российских LLM. По их оценке, средняя стоимость минимального набора ускорителей Nvidia для развертывания одной ИИ-модели выросла в 2,8 раза.
В исследование MWS Cloud вошли популярные открытые ИИ-модели, выпущенные весной и летом 2025 и 2026 годов. Расчеты учитывали минимальное количество видеокарт, необходимых для запуска ИИ-модели и обработки одного запроса максимального заявленного размера. В итоговую стоимость включены серверы с графическими процессорами и коммутаторы.
Новые поколения LLM становятся мощнее, лучше справляются со сложными задачами и способны обрабатывать больший объем информации в одном запросе. Это требует больше видеопамяти и производительных ускорителей. Одновременно в 2026 году растет рыночная стоимость самих графических процессоров, что увеличивает затраты на развертывание ИИ-моделей на собственной ИТ-инфраструктуре.
MWS Cloud также оценила возможность использования китайских ускорителей Huawei Ascend 910B. Подтвержденная возможность запуска есть не для всех рассмотренных ИИ-моделей: в выборке 2025 года — для трех из шести, в 2026 году — для пяти из семи. Среди моделей с подтвержденной или экспериментально подтвержденной поддержкой Huawei в 2025 году в среднем требовалось 10,7 ускорителя Ascend 910B, а в 2026 году — 13,6. Официальной цены на эти GPU нет, но, по оценкам, она может составлять от половины до двух третей стоимости сопоставимых решений Nvidia.
Рынок сталкивается с двойным давлением: ИИ-модели становятся мощнее и требовательнее к ресурсам, а стоимость ускорителей продолжает расти. В этих условиях компании чаще рассматривают облачные решения и альтернативные вычислительные платформы как способ сохранить доступ к передовым ИИ-технологиям без чрезмерных капитальных затрат. Если покупка ИТ-оборудования в 2026 году перестает окупаться, российские компании выбирают более компактные ИИ-модели, оптимизируют вычисления или переходят в облако, где можно платить только за фактически используемые мощности.
По оценке MWS Cloud, в первом полугодии 2026 года потребление китайских LLM российскими компаниями на платформах MWS GPT Model Hub и MWS GPT более чем в 11 раз превысило показатель за весь 2025 год.
Отечественный ИИ-рынок растет в два раза быстрее рынка ИТ в целом. Более половины российских компаний внедряют ИИ в различные бизнес-процессы. В 2025 году они инвестировали в такие проекты 257 млрд рублей. По оценкам MWS AI, в 2025 году рынок ИИ-решений в России достиг 90-135 млрд рублей, что является ростом более чем на 48% год к году. Основной вклад в рост рынка вносит крупный бизнес: финансовые организации, ритейл, телеком. Здесь активно применяются ИИ-ассистенты, чат-боты, в меньшей степени — ИИ-агенты. Автоматизация охватывает финансовый блок, аналитику данных, взаимодействие с клиентами, маркетинг, управление персоналом. Крупные организации выстраивают ИИ-инфраструктуру внутри своего контура, используют готовые платформенные решения или разрабатывают ИИ-системы под собственные задачи.
Подписывайтесь на наш Telegram-канал, чтобы быть в курсе всех новостей и событий Рунета.