Правила оказания услуги «Виртуальная инфраструктура с GPU»
Дата публикации: 05 августа 2026 г.
1. ТЕРМИНЫ И ОПРЕДЕЛЕНИЯ
Кластер – группа серверов одной конфигурации, объединенных с помощью коммуникационных каналов для совместного решения определенного вида информационно-вычислительных задач.
GPU passthrough – функция, которая позволяет подключить физический графический процессор, установленный на физическом сервере, к виртуальной машине. Таким образом виртуальная машина может напрямую использовать физический графический процессор.
Профиль GPU – виртуальный графический процессор, созданный по технологии, которая позволяет предоставлять ресурсы графического процессора (GPU) напрямую сразу нескольким виртуальным машинам.
MIG (Multi-Instance Graphics) – технология виртуализации GPU, которая позволяет разделить один графический процессор на несколько независимых GPU. Каждая часть имеет собственные ресурсы (память, вычислительные блоки) и может работать изолированно от других.
Mount point (точка монтирования в Linux) – каталог в файловой системе, в который подключается другая файловая система. Он предназначен для доступа к файлам и папкам, находящимся на подключенном устройстве.
CPU Ready – параметр, который измеряет время, в течение которого Виртуальная машина ожидает доступа к процессору на физическом сервере в виртуализированной среде.
Используемые сокращения:
BPS – бит в секунду.
2. ОПРЕДЕЛЕНИЕ УСЛУГИ
2.1. В рамках Услуги Исполнитель предоставляет Заказчику возможность заказа и получения доступа к Виртуальным машинам типовой конфигурации с графическими процессорами (GPU NVIDIA). В стандартном варианте организации Услуги Заказчик получает удаленный доступ к Виртуальным машинам через сеть Интернет.
2.2. Услуга предоставляется в следующих вариантах:
2.2.1. «Виртуальные машины с GPU», Заказчику доступны типовые шаблоны конфигураций с выделенными физическими GPU по технологии Passthrough.
2.2.2. «Виртуальные машины с профилями GPU», Заказчику доступны типовые шаблоны конфигураций с выделенными профилями GPU.
2.2.3. «Linux контейнеры с GPU», Заказчику доступны типовые шаблоны конфигураций Linux контейнеров c выделенным экземпляром GPU по технологии MIG.
2.3. Выбор вариант услуги согласно п.2.2. предоставляется при наличии технической возможности у Исполнителя.
2.4. Исполнитель предоставляет консультации Заказчику по вопросам использования Услуги и обеспечивает устранение Инцидентов в рамках оказания Технической поддержки.
2.5. Исполнитель предоставляет Заказчику в составе Услуги драйверы, указанные в справочном центре на сайте Исполнителя по адресу https://www.cloud.rt.ru/showcase/help. В случае, если Заказчик самостоятельно произведет смену драйвера, Исполнитель не гарантирует надлежащее оказание и Доступность Услуги.
3. ХАРАКТЕРИСТИКИ И ОГРАНИЧЕНИЯ УСЛУГИ
3.1. Услуга является Тарифицируемой услугой.
3.2. Исполнитель обеспечивает Доступность Услуги:
3.2.1. не менее 99,95% для «Виртуальных машин с GPU» и «Виртуальных машин с профилями GPU»;
3.2.2. не менее 99,0% для «Linux контейнеров с GPU».
3.3. Исполнитель не предъявляет требований к оборудованию Заказчика для оказания Услуги. Для заказа и управления Услугой Заказчику необходимо любое устройство с доступом к Интернет и установленным современным веб-браузером, при этом пропускная способность канала Интернет у Заказчика должна быть не менее 128 кбит/с.
3.4. Исполнитель установил следующие ограничения ресурсов на 1 Виртуальную машину[1]:
3.4.1. для варианта «Виртуальные машины с GPU»:
- Сегмент GPU NVIDIA L4:
- количество GPU от 1 до 8 штук;
- минимальное значение: 32 vCPU, 128 Гб (RAM);
- максимальное значение: 256 vCPU, 1048 Гб (RAM).
- Сегмент с GPU NVIDIA L40S:
- количество GPU от 1 до 8 штук;
- минимальное значение: 32 vCPU, 192 Гб (RAM);
- максимальное значение: 256 vCPU, 1536 Гб (RAM).
- Сегмент GPU NVIDIA H200:
- количество GPU от 1 до 8 штук;
- минимальное значение: 56 vCPU, 256 Гб (RAM);
- максимальное значение: 448 vCPU, 2048 Гб (RAM).
3.4.2. для варианта «Виртуальные машины с профилями GPU»:
- Сегмент NVIDIA L4:
- минимальное значение: 4 vCPU, 16 Гб (RAM);
- максимальное значение: 32 vCPU, 128 Гб (RAM);
- возможные профили GPU: 3 ГБ, 6 ГБ, 12 ГБ, 24 ГБ.
- Сегмент vGPU NVIDIA L40S:
- минимальное значение: 4 vCPU, 24 Гб (RAM);
- максимальное значение: 32 vCPU, 192 Гб (RAM);
- возможные профили GPU: 6 ГБ, 12 ГБ, 24 ГБ, 48 ГБ.
3.4.3. для варианта «Linux контейнеры с GPU»:
- Сегмент GPU NVIDIA H200:
- минимальное значение: 14 vCPU, 64 Гб (RAM);
- максимальное значение: 56 vCPU, 256 Гб (RAM);
- возможные экземпляры GPU: 1/7 х GPU H200 (1g35gb), 2/7 х GPU H200 (2g35gb), 3/7 х GPU H200 (3g71gb), 4/7 х GPU H200 (4g71gb), 7/7 х GPU H200 (7g141gb).
3.4.4. Максимальное количество дисков для Услуг «Виртуальные машины с GPU» и «Виртуальных машин с профилями GPU» на 1 Виртуальную машину – не более 30 (тридцати);
3.4.5. Максимальное количество Mount point для Услуги «Linux контейнеры с GPU» на 1 Контейнер – не более 30 (тридцати);
3.5. Максимальная производительность каждого диска Виртуальной машины или контейнера в зависимости от типа диска:
3.5.1. SSD – 5000 IOPS/ТБ, но не более 30 000 IOPS на диск (при размере блока 4 КБ) или 1000 MBps на диск (при размере блока 32КБ).
3.6. Среднее время доступа к дискам Виртуальных машин в зависимости от типа диска:
3.6.1. SSD – до 3 мс.
4. СХЕМА ПЕРЕРАСЧЕТА СТОИМОСТИ УСЛУГИ
4.1. Схема перерасчета стоимости Услуг «Виртуальные машины с GPU» и «Виртуальные машины с профилями GPU» в случае, если фактическая Доступность Услуги за Отчетный период не соответствует значениям указанным в п. 3.2.1., представлена в Таблице № 1.
Таблица № 1. Схема перерасчета стоимости Услуг «Виртуальные машины с GPU» и «Виртуальные машины с профилями GPU»
| Доступность Услуги в Отчетный период, % | Перерасчет стоимости оказания Услуги, % от стоимости оказания Услуги в Отчетном периоде |
|---|---|
| 100.00 > Доступность Услуги ≥ 99.95 | 0% |
| 99.95 > Доступность Услуги ≥ 99.443 | 3% |
| 99.443 > Доступность Услуги ≥ 98.998 | 5% |
| 98.998 > Доступность Услуги ≥ 98.649 | 7% |
| 98.649 > Доступность Услуги ≥ 98.333 | 10% |
| 98.333 > Доступность Услуги | 10% + (1/730)*x*100%, где x – суммарное количество часов перерывов в оказании Услуги |
4.2. Схема перерасчета стоимости Услуги «Linux контейнеры с GPU» в случае, если фактическая Доступность Услуги за Отчетный период не соответствует значениям указанным в п. 3.2.2., представлена в Таблице № 2.
Таблица № 2. Схема перерасчета стоимости Услуги «Linux контейнеры с GPU»
| Доступность Услуги в Отчетный период, % | Перерасчет стоимости оказания Услуги, % от стоимости оказания Услуги в Отчетном периоде |
|---|---|
| 100.00 > Доступность Услуги ≥ 99.00 | 0% |
| 99.00 > Доступность Услуги ≥ 98.50 | 3% |
| 98.50 > Доступность Услуги ≥ 97.50 | 5% |
| 97.50 > Доступность Услуги ≥ 96.50 | 7% |
| 96.50 > Доступность Услуги ≥ 95.50 | 10% |
| 95.50 > Доступность Услуги | 10% + (1/730)*x*100%, где x – суммарное количество часов перерывов в оказании Услуги |
[1] Список доступных к заказу конфигураций Виртуальных машин для каждого варианта Услуги представлен в Личном кабинете.