32 vCPU / 32 ГБ RAM · Россия
Выделенный сервер с 4×NVIDIA L40
от 323 300 ₽/мес· от 80 825 ₽/мес за карту
Выберите GPU
| GPU | vCPU / RAM | Страна | ||
|---|---|---|---|---|
NVIDIA L40 1Dedic 48 ГБ × 4 = 192 ГБ | 32 vCPU / 32 ГБ RAM | Россия | 323 300 ₽/мес ≈ 80 825 ₽/мес / карта | Перейти → |
Почему NVIDIA L40 на 4 GPU
4 карты L40, 192 ГБ суммарного VRAM: конфигурация для полного 70B-класса в FP16 без флагманского ценника. Каждая карта даёт 48 ГБ, и в связке из четырёх память и вычислительные ядра масштабируются для серьёзных задач. Dedicated-режим тут обязателен: все карты и весь сервер работают только на вашу задачу, без соседей по vGPU. Тариф у 1Dedic, 323 300 ₽/мес.
Несколько карт и суммарная память
У L40 нет NVLink: четыре карты объединяются как multi-GPU через шину PCIe. tensor parallelism раскладывает модель по картам, а обмен данными идёт по PCIe, без выделенного межкарточного канала. Суммарные 192 ГБ образуют общий пул памяти, но обмен градиентами по PCIe ограничивает масштабирование. Поэтому такая связка подходит для инференса и объёмных задач памяти, а для интенсивного обучения на многих картах эффективнее NVLink-ускорители.
Что помещается в эту конфигурацию
192 ГБ суммарного VRAM, полный файнтюнинг моделей 70B-класса в FP16 с запасом под батч, градиенты и контекст. Для инференса, несколько больших моделей одновременно. По сравнению с одной картой (48 ГБ) это шаг на два класса вверх: то, что не влезало в 96 ГБ, здесь помещается целиком.
Альтернативы
4 карты L40 (192 ГБ, 323 300 ₽/мес), способ получить 192 ГБ без флагманского ценника: 4×L40S (349 700 ₽/мес) дороже, а 4×L4 (208 900 ₽/мес) дешевле. Все три связки без NVLink, обмен по PCIe. Если хватает 96 ГБ, 2×L40 за 190 900 ₽/мес почти вдвое дешевле. Если важнее цена за объём, 8×L4 отдаст те же 192 ГБ за 208 900 ₽/мес. Флагманы (H100 с NVLink) имеют смысл, только если нужны специфические форматы и ещё большие пулы памяти.