GPUИндекс

Выделенный сервер с 2×NVIDIA H100

от 522 300 ₽/мес· от 261 150 ₽/мес за карту

Выберите GPU

2СброситьH100Сбросить
NVIDIA H100
1Dedic
80 ГБ × 2 = 160 ГБ
522 300 ₽/мес
261 150 ₽/мес / карта
Перейти →

32 vCPU / 32 ГБ RAM · Россия

NVIDIA H100
Reg.Cloud
80 ГБ × 2 = 160 ГБ
588 500 ₽/мес
294 250 ₽/мес / карта
Перейти →

24 vCPU / 512 ГБ RAM · Россия

Почему NVIDIA H100 на 2 GPU

Пара H100, это точка входа в multi-GPU без переплаты за 4–8 карт: 160 ГБ суммарного VRAM закрывают инференс моделей 70B в 4-битной квантизации и полный файнтюнинг до 34B в FP16. Когда одной карте тесно, а 4-карточная машина избыточна, две H100 дают ровно тот класс задач, который «не влез» в 80 ГБ. В Dedicated-режиме обе карты работают только на вас: длинные обучения и продакшн-инференс не замедляются соседями по vGPU. Конфигурацию 2×80 ГБ предлагают 1Dedic, Reg.Cloud от 522 300 ₽/мес.

Несколько карт и суммарная память

2×80 ГБ, это не карта на 160 ГБ: такой карты не существует, сумма складывается из двух ускорителей. Если карты связаны NVLink, они работают как единая связка: tensor parallelism распределяет веса по обеим картам, а обмен идёт по быстрому межкарточному каналу (до 900 ГБ/с у H100 SXM), а не по PCIe. Если связь только по PCIe, суммарные 160 ГБ всё равно складываются в общий пул, но обмен данными медленнее. Поэтому прирост у пары — в первую очередь по объёму памяти, а скорость масштабирования зависит от того, как карты связаны у конкретного провайдера.

Что помещается в эту конфигурацию

В 160 ГБ суммарного VRAM помещается инференс моделей класса 70B в 4-битной квантизации и полный файнтюнинг до 34B в FP16, с запасом под батч и контекст. Для сервинга можно держать пару средних моделей одновременно. Это конфигурация, где 70B становится достижим без перехода в ценник 4-карточных машин: память позволяет не резать веса ниже 4-бит, а файнтюнинг 34B-класса идёт в полной точности.

Альтернативы

Если модель помещается в 80 ГБ, одной H100 достаточно: это от 217 280 ₽/мес у HOSTER.BY, заметно дешевле. Пара карт нужна, когда задача не влезает в одну: 70B в 4-бит или файнтюнинг 34B-класса в FP16. Сравнение с соседями: 4×H100 (320 ГБ) стоят от 986 100 ₽/мес и открывают полный FP16 70B-класса, если нужен именно он, берите 4 карты. Тот же суммарный объём 160 ГБ есть у 2×A100 80GB за 538 400 ₽/мес, но H100 быстрее в современных форматах вычислений. vGPU дешевле, но делит карту с соседями.

Частые вопросы

Сколько стоит сервер на 2 H100?+
Конфигурацию 2×80 ГБ предлагают 1Dedic, Reg.Cloud: 1Dedic, 522 300 ₽/мес, Reg.Cloud, 588 500 ₽/мес. В пересчёте на карту это около 261 150 ₽/мес.
Что помещается в 160 ГБ суммарного VRAM?+
Инференс моделей класса 70B в 4-битной квантизации, полный файнтюнинг до 34B в FP16, несколько средних моделей одновременно для сервинга. Для полного FP16 70B нужны 4 карты (320 ГБ).
Чем 2×H100 отличаются от 4×H100?+
2 карты дают 160 ГБ, это 70B в 4-бит и файнтюнинг до 34B в FP16. 4 карты (320 ГБ) открывают полный файнтюнинг 70B-класса в FP16, но стоят вдвое дороже. Если 4-бит для вашей задачи достаточно, пары хватает.
Когда хватит одной H100, а когда нужно две?+
Одной карты достаточно для инференса моделей до 34B и LoRA-дообучения. Две карты берут, когда модель крупнее и не помещается в 80 ГБ целиком: tensor parallelism распределяет веса по картам, и суммарные 160 ГБ работают как единый пул.