На предыдущую страницу
Блог

Как выбрать провайдера облачного GPU: SLA, тарификация и скрытые расходы

Спрос на серверы с графическими ускорителями (GPU) увеличивается во всем мире. Как следствие, на них растут цены и затягиваются сроки поставки. Аренда облачных GPU позволяет получить вычислительные ресурсы без закупки собственного оборудования и ожидания его поставки.

На российском рынке несколько десятков облачных провайдеров, и многие из них предлагают в аренду серверы с графическими ускорителями. Для бизнеса самый простой способ сравнения при выборе — цена GPU-часа. Хотя такой подход имеет право на жизнь, он не отражает итоговые затраты и качество сервиса.

Из чего складывается стоимость аренды GPU

Цена GPU-часа показывает не все расходы на облачную инфраструктуру. Итоговый счет зависит от того, что входит в тариф и какие ресурсы оплачиваются сверх него. Состав услуги у провайдеров различается, поэтому GPU-часы разных провайдеров нельзя сравнивать напрямую.

Что входит в тариф

Клиент арендует виртуальную машину с GPU. В зависимости от тарифа в ее состав могут входить:

  • один или несколько GPU либо часть GPU, вместе с видеопамятью;
  • процессорные ядра (vCPU) и оперативная память;
  • диск для операционной системы и данных;
  • сетевое подключение;
  • в ряде случаев образ ОС с предустановленными драйверами и библиотеками для GPU.

Провайдеры формируют тариф по одной из двух моделей.

Готовая конфигурация

GPU, vCPU и оперативная память продаются одним набором по единой цене. Иногда в набор входит и диск.

Покомпонентная оплата

Каждый ресурс тарифицируется отдельно. Цена GPU-часа не включает vCPU, оперативную память и диски.

Поэтому сравнивать стоит цену сопоставимой конфигурации: та же модель и то же число GPU, тот же объем памяти и дисков.

Что может оплачиваться отдельно. Исходящий трафик, хранилище, публичные IP-адреса, снапшоты, резервное копирование и лицензии ОС и ПО.

Исходящий трафик

Исходящий трафик — это данные, которые компания выгружает из облака. Входящий трафик, то есть загрузка данных в облако, обычно бесплатный.

Условия по исходящему трафику сильно различаются. У одних провайдеров он не тарифицируется совсем. У других бесплатна только месячная квота, а каждый гигабайт сверх нее оплачивается.

В ИИ-проектах объемы исходящего трафика бывают большими. Крупная модель или контрольные точки обучения, то есть сохраненные промежуточные состояния модели, весят десятки и сотни гигабайт. Поэтому важно выяснить размер бесплатного объема и цену трафика сверх него.

Хранилище

GPU-серверу нужно хранилище для датасетов, моделей и промежуточных результатов обучения. В готовых конфигурациях диск иногда входит в тариф. Дополнительные диски и хранилище для больших объемов данных обычно оплачиваются отдельно.

Провайдеры предлагают разные типы хранилища:

  • Локальный NVMe-диск. Установлен в самом сервере и работает быстрее всего, но данные на нем, как правило, теряются при удалении сервера.
  • Сетевые диски. Работают медленнее, зато данные сохраняются независимо от сервера.
  • Объектное хранилище. Подходит для датасетов и архивов моделей большого объема.

Скорость хранилища косвенно влияет на стоимость аренды GPU. Если данные поступают медленно, GPU простаивает, а задача выполняется дольше.

Обычно при остановке сервера плата за GPU, процессор и память прекращается. Диски и публичный IP-адрес продолжают тарифицироваться, пока их не удалят.

Тарификация и срок аренды

Провайдеры предлагают посекундную, поминутную, почасовую, посуточную или помесячную оплату. У некоторых провайдеров при почасовой схеме 10-минутный запуск оплачивается как полный час. На длительном обучении разница невелика, а на коротких экспериментах и частых перезапусках она существенна.

Для пилотных проектов и переменной нагрузки важна возможность остановить сервер и не платить за GPU, пока он не нужен. Иначе компания оплачивает время, когда сервер работает без задачи.

Некоторые провайдеры устанавливают минимальный срок аренды: от одного часа до месяца. За долгосрочную аренду или резервирование ресурсов предоставляются скидки, размер которых у каждого провайдера свой.

Стоимость смены провайдера

При выборе провайдера обычно не учитывают расходы на переезд к другому. При смене провайдера из облака выгружают все данные и модели. Это самая крупная выгрузка за весь проект, и, как правило, она тарифицируется как обычный исходящий трафик.

Трафиком расходы не ограничиваются. Команде нужно время на перенос и перенастройку. Если проект завязан на сервисы, которых нет у нового провайдера, их придется заменять.

SLA и компенсация за простой

SLA (соглашение об уровне обслуживания) фиксирует гарантии провайдера: доступность ресурсов, время реакции поддержки и компенсации при нарушениях. При сравнении провайдеров в SLA важно проверить три параметра: процент доступности, перечень ресурсов и размер компенсации.

Что означает «доступность 99,9%»

Доступность по SLA — это доля времени, в течение которого ресурс должен оставаться работоспособным. В таблице значения в процентах выглядят почти одинаково, но в часах разница существенная.

SLA Допустимый простой в месяц Допустимый простой в год
99% ≈7,2 часа ≈3,7 суток
99,5% ≈3,6 часа ≈1,8 суток
99,9% ≈43 минуты ≈8,8 часа
99,95% ≈22 минуты ≈4,4 часа
99,99% ≈4,3 минуты ≈53 минуты

Разница между 99,9% и 99,99% десятикратная. Это около 43 минут простоя в месяц против четырех.

Что входит в SLA

Некоторые провайдеры не выделяют GPU в SLA в отдельную категорию. Гарантия распространяется на виртуальную машину и сеть, и отказ ускорителя при работающей машине нарушением не считается. Кроме того, плановые работы часто исключают из расчета доступности. Поэтому перед подписанием договора важно проверить, какие периоды и типы работ не учитываются при расчете SLA.

Помимо SLA на инфраструктуру, провайдеры заключают SLA на управление. Оно фиксирует время реакции поддержки и срок решения инцидентов. GPU-проекту важны оба соглашения: даже при безупречной работе оборудования проект останавливается, если критичную заявку поддержка выполняет через сутки.

Компенсация при простое

Обычно провайдер компенсирует простой скидкой на будущие услуги. Размер компенсации, как правило, ограничен стоимостью услуг за период, в котором произошел простой. Порядок фиксации простоя, срок подачи претензии и минимальная длительность сбоя прописаны в договоре, и их важно проверить до подписания.

Потери бизнеса от простоя могут быть значительными. Согласно исследованию Splunk и Oxford Economics 2026 года, средняя стоимость минуты простоя для организаций из Global 2000 составляет около $15 000, то есть около $900 000 в час. Точных данных по России нет.

Формат GPU и гарантии производительности

GPU предоставляют целиком или с разделением между несколькими клиентами. От формата зависит стабильность и скорость выполнения задач.

Основных форматов три:

GPU целиком Ускоритель целиком закрепляется за одной виртуальной машиной через технологию passthrough или предоставляется в составе выделенного физического сервера.
Time-sliced vGPU Несколько виртуальных машин используют один GPU по очереди. Каждой ВМ выделяется собственный объем видеопамяти, а вычислительные ресурсы распределяются по времени.
MIG На GPU с поддержкой MIG ускоритель разделяется на аппаратно изолированные части с выделенными вычислительными ресурсами и памятью.

Большую часть серверных GPU на рынке выпускает NVIDIA. Для NVIDIA vGPU for Compute требуется действующая лицензия NVIDIA AI Enterprise. Без нее после льготного периода vGPU переходит в режим ограниченной производительности. Такая лицензия есть не у всех провайдеров, поэтому ее наличие стоит уточнить заранее.

При time-sliced vGPU виртуальные машины делят вычислительное время ускорителя, поэтому при одновременной нагрузке производительность может снижаться. MIG выделяет каждой части собственные вычислительные ресурсы и память, что делает производительность более предсказуемой. SLA обычно фиксирует доступность ресурса. Если гарантии производительности в договоре нет, падение скорости нарушением не считается.

Парк GPU и наличие карт

От парка GPU зависит, какие задачи удастся решать и как быстро получится нарастить мощность. Ключевые параметры: поколение карт, их наличие и сроки замены.

Для обучения крупных моделей используют H200 и B200. RTX PRO 6000 Blackwell Server Edition подходит для инференса и fine tuning. Провайдер с устаревшими картами может предложить низкую цену, но задача займет больше времени, и итоговая стоимость может оказаться высокой.

Для задач на нескольких GPU важна скорость обмена данными. Внутри сервера для связи между ускорителями может использоваться технология NVLink, а между серверами InfiniBand или Ethernet с RoCE. При медленной связи карты простаивают в ожидании данных.

Карта из каталога может быть уже установлена в дата-центре или доступна только под заказ. Поэтому при выборе провайдера важно уточнить фактическое наличие оборудования и сроки подключения дополнительной мощности. В исследовании «Компьютерры» 2026 года 23,2% пользователей GPU-инфраструктуры назвали дефицит оборудования: серверов и стоек главной проблемой рынка.

GPU выходят из строя даже в надежном дата-центре. Важно выяснить, держит ли провайдер резерв карт на площадке и в какой срок заменяет неисправные. Провайдер также может рассказать, какие GPU появятся у него в ближайшие 12–18 месяцев. Это показывает, что он инвестирует в парк оборудования и клиент не останется на устаревшей инфраструктуре.

Надежность и расположение дата-центра

При оценке дата-центра стоит проверить его уровень Tier и тип сертификата Uptime Institute. Tier Certification of Design Documents подтверждает соответствие проектной документации требованиям выбранного Tier, а Tier Certification of Constructed Facility подтверждает уже построенный объект. Поэтому одного упоминания Tier III без типа сертификата недостаточно.

От расположения дата-центра зависит задержка при работе с данными. Чем дальше площадка от пользователей и систем компании, тем она выше. Еще один параметр — геораспределенность. Если у компании филиалы находятся в нескольких странах, то ей не стоит выбирать провайдера с дата-центрами только в Москве.

Соответствие 152-ФЗ

Обработка персональных данных в облаке регулируется 152-ФЗ. Требование локализовать персональные данные граждан России действует с 2015 года после изменений, внесенных 242-ФЗ. С 1 июля 2025 года 23-ФЗ запретил при сборе персональных данных граждан России использовать для этих операций базы данных за пределами страны, кроме предусмотренных законом случаев.

Уровень защищенности зависит от категории персональных данных, типа актуальных угроз, количества субъектов и того, являются ли они сотрудниками оператора. Провайдер обрабатывает данные по поручению клиента.

При выборе провайдера стоит проверить, какой уровень защищенности поддерживает его сегмент и какие меры остаются на стороне оператора персональных данных.

Тестовый период

Заявленные характеристики не всегда совпадают с реальной производительностью. Поэтому до подписания договора стоит запросить тестовый период. Его предоставляют не все провайдеры.

На тесте запускают тот же код и те же данные, что будут использоваться в работе. Результат показывает время выполнения задачи и ее стоимость у конкретного провайдера. Для сравнения провайдеров этот показатель информативнее цены GPU-часа.

Результат теста корректен, только если конфигурация совпадает с договорной: та же модель GPU, тот же формат, тот же тип хранилища. Если используется time-sliced vGPU, задачу стоит запустить несколько раз в разное время суток. Так можно оценить, насколько производительность зависит от нагрузки других виртуальных машин.

Чек-лист для сравнения провайдеров

Все параметры лучше всего свести в одну таблицу и сопоставить предложения разных провайдеров.

Критерий Что уточнить Почему это важно
Полная стоимость Состав конфигурации и что оплачивается сверх нее: исходящий трафик, хранилище, снапшоты, IP-адреса GPU-час у разных провайдеров покрывает разный набор ресурсов
Тарификация и срок аренды Шаг тарификации, минимальный срок, скидки за долгосрочную аренду Округление времени и минимальный срок увеличивают счет при переменной нагрузке
Хранилище Типы и стоимость хранилища, плата за хранилище при остановленном сервере Хранилище может замедлять работу даже быстрого GPU
Смена провайдера Стоимость выгрузки всех данных Переезд требует самой крупной выгрузки за проект
SLA на инфраструктуру Входит ли GPU в SLA, какие работы исключены из расчета Процент доступности без условий мало что гарантирует
SLA на управление Время реакции и решения, состав сопровождения От поддержки зависит длительность простоя при сбое
Производительность Формат GPU, лицензия на vGPU, гарантия производительности Без действующей лицензии производительность vGPU имеет ограничения
Парк GPU Модели карт, наличие, резерв мощности, срок замены От парка зависят сроки проекта и возможность масштабирования
Дата-центр Уровень сертификата Tier, расположение площадки Влияет на надежность и задержку
152-ФЗ Сегмент под 152-ФЗ, уровень защищенности Нарушение требований грозит штрафами
Тестовый период Есть ли тестовый период для GPU, совпадает ли конфигурация с договорной Реальная производительность может отличаться от заявленной

GPU-инфраструктура ITGLOBAL.COM

ITGLOBAL.COM предоставляет в аренду вычислительные мощности с GPU в 10 странах. Помимо России, это Беларусь, Казахстан, Узбекистан, Китай, ОАЭ и Бразилия. В инфраструктуре доступны современные ускорители NVIDIA, включая H200, B300 и RTX PRO 6000 Blackwell Server Edition. Формат можно выбрать под задачу и требования к данным.

Облачный сервис аренды виртуальных машин с графическими ускорителями. Подходит для пилотных проектов и переменной нагрузки.
Физический сервер с GPU в единоличном пользовании клиента.
Изолированная среда для корпоративных приложений, данных и ИИ-сервисов в инфраструктуре, которая отвечает требованиям 152-ФЗ.
Единый API к российским и зарубежным моделям. Оплата идет за токены, собственные GPU не нужны.

Частые вопросы

Итоговая стоимость зависит от состава тарифа. В одних тарифах GPU, процессор и память продаются одной конфигурацией, в других каждый ресурс оплачивается отдельно. Сверх тарифа обычно оплачиваются исходящий трафик и хранилище, иногда снапшоты, IP-адреса и лицензии. Отдельная статья расходов — выгрузка всех данных при смене провайдера.

Важно выяснить, входит ли GPU в SLA и какие плановые работы исключены из расчета доступности. Также стоит проверить SLA на управление: время реакции поддержки и срок решения инцидентов.

Как правило, компенсация по SLA не покрывает убытки бизнеса. Ее предоставляют в виде скидки на будущие услуги, и размер обычно ограничен стоимостью услуг за период простоя.

Да, если сегмент провайдера поддерживает необходимый уровень защищенности, а оператор персональных данных выполнил свою часть организационных и технических мер.

Нет. Тестовый период предоставляют не все провайдеры, поэтому его наличие стоит уточнить при сравнении.

Оцените данную статью

Узнавайте о выходе новых статей в блоге первыми!

Подпишитесь на нашу рассылку