19.08.2026 Новости, Искусственный интеллектMWS Cloud (входит в МТС Web Services) проанализировала требования к вычислительной инфраструктуре для запуска ведущих мировых и российских больших языковых моделей. По оценке компании, средняя стоимость минимального набора ускорителей Nvidia для запуска одной модели выросла с 13,7 млн. рублей в 2025 году до 38,8 млн. рублей в 2026 году — в 2,8 раза. В анализ вошли популярные открытые модели, выпущенные весной и летом соответствующего года. Для 2025 года рассматривались Kimi K2, gpt-oss-120b, Gemma 3 27B, GLM-4.5V, Qwen3 235B и российская Cotype Pro 2. Для 2026 года — Kimi K3, Qwen3.5 397B, DeepSeek-V4-Pro, DeepSeek-V4-Flash, GLM-5.2, Gemma 4 и Cotype Pro 3. Расчёт сделан для минимального количества видеокарт, необходимого для запуска модели и обработки одного запроса максимального заявленного размера. В стоимость включены серверы с GPU и коммутаторы к ним. Год Наиболее популярный GPU Другие GPU 2025 H100 — для трёх из шести моделей H200 — для двух моделей; A100 — для одной 2026 H200 — для трёх из семи моделей B300 — для двух моделей; H100 и A100 — ещё для двух Рейтинг моделей по стоимости запуска в 2025 году Место Модель Количество параметров Минимальная конфигурация Стоимость 1 Kimi K2 1 трлн (32 млрд. активных) 8 × H200 141 Гб ...
читать далее.