Сервер для ИИ
Аренда сервера для ИИ: GPU на час или на месяц для обучения, локальных моделей и нейросетей. Покупать железо нет смысла, если задачи на недели и месяцы.
Сравниваем выделенные и облачные карты у 34 провайдеров в России и СНГ. T4 и 4090 для старта, A100 и L40S для LLM, H100 и H200 для обучения с нуля.
GPU для локального ИИ
Ollama и чат 7-13B сидят на 24 ГБ, это RTX 4090. Эмбеддинги и Whisper хватает T4 или L4. 70B в кванте уже 48 ГБ: L40S или A100.
| GPU | Память | Применение | ₽/час↑ | ≈ в месяц | |
|---|---|---|---|---|---|
24 ГБGDDR6X | от 17,99 ₽/час | ≈ 13 134 ₽ | 173 предложения → | ||
16 ГБGDDR6 | от 19,18 ₽/час | ≈ 14 001 ₽ | 56 предложений → | ||
24 ГБGDDR6 | от 25,68 ₽/час | ≈ 18 746 ₽ | 22 предложения → | ||
24 ГБGDDR6 | от 35,77 ₽/час vGPU от 6,63 ₽/час | ≈ 26 112 ₽ | 31 предложение → |
GPU для LLM
Локальный чат, API и дообучение. 4090 и 5090 для 7-13B. L40S, A6000 и A100 для моделей покрупнее. RTX 6000 PRO даёт 96 ГБ на GDDR7.
| GPU | Память | Применение | ₽/час↑ | ≈ в месяц | |
|---|---|---|---|---|---|
32 ГБGDDR7 | от 24,84 ₽/час | ≈ 18 133 ₽ | 171 предложение → | ||
40 ГБHBM2 | от 39,85 ₽/час | ≈ 29 091 ₽ | 17 предложений → | ||
48 ГБGDDR6 | от 97,00 ₽/час | ≈ 70 810 ₽ | 10 предложений → | ||
48 ГБGDDR6 | от 106,25 ₽/час vGPU от 12,46 ₽/час | ≈ 77 563 ₽ | 18 предложений → | ||
96 ГБGDDR7 | от 134,75 ₽/час | ≈ 98 368 ₽ | 38 предложений → | ||
80 ГБHBM2e | от 185,00 ₽/час | ≈ 135 050 ₽ | 50 предложений → |
Сервер для обучения ИИ
Обучение с нуля: HBM и NVLink, карты передают данные напрямую. A100 80GB, H100, H200. B200 и B300 для больших прогонов.
| GPU | Память | Применение | ₽/час↑ | ≈ в месяц | |
|---|---|---|---|---|---|
80 ГБHBM3 | от 242,00 ₽/час | ≈ 176 660 ₽ | 42 предложения → | ||
94 ГБHBM3 | от 364,74 ₽/час | ≈ 266 257 ₽ | 4 предложения → | ||
141 ГБHBM3e | от 375,00 ₽/час | ≈ 273 750 ₽ | 23 предложения → | ||
141 ГБHBM3e | от 569,59 ₽/час | ≈ 415 801 ₽ | 2 предложения → | ||
180 ГБHBM3e | от 842,16 ₽/час | ≈ 614 777 ₽ | 3 предложения → | ||
288 ГБHBM3e | от 1 100,42 ₽/час | ≈ 803 307 ₽ | 4 предложения → |
Что такое сервер для ИИ
Сервер для ИИ это машина с GPU: карта считает, VRAM держит веса модели и контекст. Без видеокарты нейросеть не запустить, основную нагрузку тянут видеочипы.
Разница между серверами не в процессоре, а в картах: объёме памяти и связке между ними. Для инференса хватает одной карты, для обучения нужны несколько с NVLink.
Сколько нужно VRAM
Главный параметр при выборе сервера для ИИ это память карты. От объёма VRAM зависит, какую модель вы запустите и с каким контекстом.
| VRAM | Что умещается | Карты |
|---|---|---|
| 24 ГБ | Чат 7-13B, Stable Diffusion, LoRA, 3D-рендер и видеомонтаж | RTX 4090, A10, L4 |
| 32 ГБ | 7-13B с запасом, RAG, длинный контекст | RTX 5090 |
| 40-48 ГБ | Квантованный 70B, файнтюнинг | L40S, RTX A6000, A100 40GB |
| 80-96 ГБ | Крупные модели без сжатия, производственный рендер | A100 80GB, H100, RTX 6000 PRO |
| 141 ГБ и выше | Обучение с нуля, большие контексты | H200, B200, B300 |
Выделенный, облачный или vGPU
Выделенный (Dedicated) это физическая машина: карта целиком ваша, соседей на ней нет. Облачный Passthrough отдаёт полную карту в виртуальной машине, без шардинга. vGPU делит одну карту между арендаторами, поэтому дешевле.
Для обучения и длинного инференса берите выделенный сервер или полную карту: соседи не влияют на скорость. Для экспериментов и лёгких задач хватает vGPU.
Аренда или покупка сервера
Аренда выгодна на срок от часа до нескольких месяцев: платите за время работы, карту меняете под задачу, сервер выключаете, когда закончили. Покупка окупается только при круглосуточной нагрузке на годы.
GPU устаревает, и аренда снимает этот риск: всегда берёте актуальную карту у провайдера. Электричество, охлаждение и обслуживание тоже ложатся на него, а не на ваш бюджет.
Почасовая и помесячная аренда
Почасовая оплата подходит для коротких задач: инференс, эксперимент, разовый рендер. Помесячный тариф дешевле при постоянной нагрузке, когда карта крутится без пауз.