GPUИндекс

GPU для llm

Какой GPU нужен для llm. Сравните цены на аренду видеокарт.

LLM

Kimi K3

Open 2.8T MoE от Moonshot: vision + 1M контекст

VRAM от 1400 ГБ
GPU от 134,75 ₽/часAPI от 262,88 ₽/1M
LLM

DeepSeek-V3

DeepSeek-V3 / R1 671B MoE: зачем берут 8×H100

VRAM от 320 ГБ
GPU от 134,75 ₽/часAPI от 35,05 ₽/1M
LLM

Llama 405B

Llama 3.1 405B: плотная frontier на 4–8 картах

VRAM от 320 ГБ
GPU от 134,75 ₽/часAPI от 109,53 ₽/1M
LLM

Llama 4 Maverick

Llama 4 Maverick: MoE ~400B на 2–4×H100

VRAM от 160 ГБ
GPU от 134,75 ₽/часAPI от 21,91 ₽/1M
LLM

Qwen 235B

Qwen3 235B-A22B: MoE на 2–4×H100

VRAM от 160 ГБ
GPU от 134,75 ₽/часAPI от 22,95 ₽/1M
LLM

DeepSeek R1 70B

R1-Distill-Llama-70B: reasoning на одной карте 80 ГБ

VRAM от 40 ГБ
GPU от 33,69 ₽/часAPI от 3,53 ₽/1M
LLM

Llama 4 Scout

Llama 4 Scout: MoE 109B, одна карта 80 ГБ

VRAM от 40 ГБ
GPU от 33,69 ₽/часAPI от 10,95 ₽/1M
LLM

Llama 70B

Llama 3.3 70B: чат, код, RAG на одной H100

VRAM от 40 ГБ
GPU от 33,69 ₽/часAPI от 900 ₽/1M
LLM

Qwen 72B

Qwen2.5 72B: открытая 72B, сильный русский и код

VRAM от 40 ГБ
GPU от 33,69 ₽/часAPI от 35,34 ₽/1M
LLM

GLM-4

GLM-4 32B / Air: открытая модель Zhipu

VRAM от 24 ГБ
GPU от 17,99 ₽/часAPI от 14,24 ₽/1M
LLM

T-pro

RU LLM 32B, T-Bank (t-tech)

VRAM от 24 ГБ
GPU от 17,99 ₽/час
LLM

Qwen-Coder

Qwen2.5 / Qwen3 Coder: код на своей карте

VRAM от 20 ГБ
GPU от 17,99 ₽/часAPI от 3,53 ₽/1M
LLM

Gemma 3 27B

Gemma 3 27B: Google, как раз на 24 ГБ

VRAM от 16 ГБ
GPU от 15,01 ₽/часAPI от 3,53 ₽/1M
LLM

ruGPT-3.5

RU 13B, SberDevices / AI Forever

VRAM от 10 ГБ
GPU от 10,62 ₽/час
LLM

DeepSeek R1

Открытая reasoning-модель класса o1

VRAM от 8 ГБ
GPU от 4,41 ₽/часAPI от 76,67 ₽/1M
LLM

Qwen

Открытая семья LLM от Alibaba: от 0.5B до 671B

VRAM от 6 ГБ
GPU от 4,41 ₽/часAPI от 8,76 ₽/1M
LLM

T-lite

RU LLM 7B, T-Bank (t-tech)

VRAM от 6 ГБ
GPU от 4,41 ₽/час
LLM

Vikhr-7B

Открытая русскоязычная LLM 7B от Vikhrmodels

VRAM от 6 ГБ
GPU от 4,41 ₽/час
LLM

llama.cpp

Квантизованный инференс LLM на CPU и GPU

VRAM от 4 ГБ
GPU от 4,41 ₽/часAPI от 16,43 ₽/1M
LLM

Ollama

Локальный запуск LLM одной командой

VRAM от 4 ГБ
GPU от 4,41 ₽/часAPI от 16,43 ₽/1M
LLM

Open WebUI

Веб-чат к Ollama и vLLM, как у ChatGPT

VRAM от 4 ГБ
GPU от 4,41 ₽/час

Большие языковые модели (LLM) - для генерации текста, чат-ботов, анализа данных и написания кода. Можно запускать локально на GPU или использовать через API провайдеров. Сравните LLM API каталог или посмотрите все AI-инструменты.

LLM API каталог

Готовый API с оплатой в рублях

Все AI-инструменты

40 инструментов во всех категориях

Другие категории