GPUИндекс

Аренда GPU для инференса нейросетей

Для инференса важны цена, задержка и память под веса. T4, L4 и A10 для лёгких задач. 4090, L40S и A100 для LLM. H100 для больших моделей и высокого трафика.

Сравните цены на аренду видеокарт у 34 провайдеров России, Беларуси и Казахстана

Лёгкий инференс

Эмбеддинги, Whisper, YOLO, небольшие LLM

LLM

Локальный чат и API средних моделей

RTX 4090
24 ГБGDDR6X
от 17,99 ₽/час
≈ 13 134 ₽ / мес
173 предложения
RTX 5090
32 ГБGDDR7
от 24,84 ₽/час
≈ 18 133 ₽ / мес
171 предложение
A100
40 ГБHBM2
от 39,85 ₽/час
≈ 29 091 ₽ / мес
17 предложений
RTX A6000
48 ГБGDDR6
от 97,00 ₽/час
≈ 70 810 ₽ / мес
10 предложений
L40S
48 ГБGDDR6
от 106,25 ₽/час
vGPU от 12,46 ₽/час
≈ 77 563 ₽ / мес
18 предложений
RTX 6000 PRO
96 ГБGDDR7
от 134,75 ₽/час
≈ 98 368 ₽ / мес
38 предложений
A100
80 ГБHBM2e
от 185,00 ₽/час
≈ 135 050 ₽ / мес
50 предложений

Тяжёлый инференс

Большие языковые модели и высокий трафик

Эмбеддинги, Whisper, YOLO: T4 или L4. LLM API: A10, 4090, A100. Тяжёлый трафик: H100.