GPUИндекс

Выделенный сервер NVIDIA A100

A100 80GB в выделенном сервере, это карта целиком ваша: 80 ГБ HBM2e без шардинга и без соседей. В каталоге конфигурации на 1 и 2 карты по цене от 135 120 ₽/мес.

от 135 120 ₽/мес

Выберите GPU

Сервер с NVIDIA A100

A100 80GB, давно проверенный ускоритель для обучения и файнтюнинга LLM: 80 ГБ HBM2e на карту и аппаратная поддержка MIG. Но именно в Dedicated-режиме карта отдаётся одной задаче целиком: полный VRAM, без деления на изолированные инстансы и без соседей по vGPU. В каталоге конфигурации от одной до двух карт. Пара A100 даёт 160 ГБ суммарной памяти, этого хватает на полный файнтюнинг моделей класса 70B в FP16. Одна карта уверенно держит инференс и дообучение моделей до 13B.

A100Сбросить
NVIDIA A100
IHC (Интернет Хостинг Центр)
80 ГБ
220 000 ₽/мес
Перейти →

512 ГБ RAM · Россия

NVIDIA A100
SpaceWeb
80 ГБ
324 000 ₽/мес
Перейти →

56 vCPU / 1024 ГБ RAM · Россия

NVIDIA A100
SpaceWeb
80 ГБ × 2 = 160 ГБ
538 400 ₽/мес
269 200 ₽/мес / карта
Перейти →

16 vCPU / 512 ГБ RAM · Россия

NVIDIA A100
HOSTER.BY
80 ГБ
по запросу
Перейти →

128 ГБ RAM · Беларусь

Частые вопросы о выделенном сервере на A100 80GB

Сколько стоит выделенный сервер с A100 80GB?+
В каталоге 5 предложений у 4 провайдера, от 135 120 до 538 400 ₽/мес за конфигурацию. Конфигурация с одной картой стартует от 135 120 ₽/мес, две карты стоят дороже, но дают вдвое больше суммарной памяти.
Что помещается в 80 ГБ одной карты A100?+
80 ГБ, это инференс и файнтюнинг моделей до 13B в полной точности, дообучение LoRA и QLoRA для более крупных весов. Для моделей класса 70B лучше взять две карты: суммарные 160 ГБ вмещают модель целиком в FP16.
Чем Dedicated A100 отличается от vGPU с A100?+
vGPU делит одну карту между арендаторами через MIG, это дешевле, но вы получаете лишь долю VRAM и разделяемые вычислительные ядра. В Dedicated вся карта ваша: полный VRAM, вся пропускная способность памяти и предсказуемая скорость без влияния соседей.
Когда хватит одной A100, а когда нужно две?+
Одной карты достаточно для инференса, LoRA-дообучения и средних моделей. Две карты нужны, когда модель не помещается в 80 ГБ целиком: tensor parallelism распределяет веса по картам, и суммарные 160 ГБ работают как единый пул памяти.

На A100 80GB в каталоге 5 предложений у 4 провайдера, от 135 120 до 538 400 ₽/мес. Серверы размещены в дата-центрах Россия, Беларусь. Если бюджет ограничен, начните с одной карты, для инференса и LoRA-дообучения этого достаточно. Две карты берут, когда модель нужно обучить целиком в FP16: суммарные 160 ГБ позволяют не прибегать к квантованию. Сравните тарифы в таблице и выберите конфигурацию под задачу.