GPU для llm
Какой GPU нужен для llm. Сравните цены на аренду видеокарт.
Kimi K3
Open 2.8T MoE от Moonshot: vision + 1M контекст
DeepSeek-V3
DeepSeek-V3 / R1 671B MoE: зачем берут 8×H100
Llama 405B
Llama 3.1 405B: плотная frontier на 4–8 картах
Llama 4 Maverick
Llama 4 Maverick: MoE ~400B на 2–4×H100
Qwen 235B
Qwen3 235B-A22B: MoE на 2–4×H100
DeepSeek R1 70B
R1-Distill-Llama-70B: reasoning на одной карте 80 ГБ
Llama 4 Scout
Llama 4 Scout: MoE 109B, одна карта 80 ГБ
Llama 70B
Llama 3.3 70B: чат, код, RAG на одной H100
Qwen 72B
Qwen2.5 72B: открытая 72B, сильный русский и код
GLM-4
GLM-4 32B / Air: открытая модель Zhipu
T-pro
RU LLM 32B, T-Bank (t-tech)
Qwen-Coder
Qwen2.5 / Qwen3 Coder: код на своей карте
Gemma 3 27B
Gemma 3 27B: Google, как раз на 24 ГБ
ruGPT-3.5
RU 13B, SberDevices / AI Forever
DeepSeek R1
Открытая reasoning-модель класса o1
Qwen
Открытая семья LLM от Alibaba: от 0.5B до 671B
T-lite
RU LLM 7B, T-Bank (t-tech)
Vikhr-7B
Открытая русскоязычная LLM 7B от Vikhrmodels
llama.cpp
Квантизованный инференс LLM на CPU и GPU
Ollama
Локальный запуск LLM одной командой
Open WebUI
Веб-чат к Ollama и vLLM, как у ChatGPT
Большие языковые модели (LLM) - для генерации текста, чат-ботов, анализа данных и написания кода. Можно запускать локально на GPU или использовать через API провайдеров. Сравните LLM API каталог или посмотрите все AI-инструменты.
LLM API каталог
Готовый API с оплатой в рублях
Все AI-инструменты
40 инструментов во всех категориях