aibot.

Модели ИИ: каталог с ценами, контекстом и сравнением

Обновлено 16 августа 2026 · проверено редакцией

В каталоге больше трёхсот моделей, и выбирать между ними по названию бессмысленно. Здесь они собраны в таблицы по двум параметрам, которые реально определяют выбор: сколько текста модель удерживает за раз и сколько стоит миллион токенов.

Каталог моделей: сравнение по цене и контексту
Цены и окна контекста берутся из каталога шлюза — единого источника, где сведены модели всех крупных вендоров.

Семейства моделей: что есть на рынке

13 вендоров, у каждого своя линейка от лёгких моделей до флагманов. Разброс цен внутри одного семейства достигает сотни раз — поэтому «дорогой Claude» и «дешёвый Qwen» некорректное сравнение: у обоих есть и то, и другое.

семействомоделеймакс. контекстцена за 1M входных, $чем известно
ClaudeAnthropic281.0M$0.25 — $30.0модели Anthropic: Opus для сложных задач, Sonnet для повседн
GPTOpenAI941.1M$0.02 — $150.0линейка OpenAI: универсальные модели, рассуждение, генерация
GeminiGoogle391.0M$0.05 — $2.0модели Google с сильной мультимодальностью и большим окном к
DeepSeekDeepSeek131.0M$0.08 — $1.17китайские модели с открытыми весами и очень низкой ценой за
QwenAlibaba501.0M$0.03 — $2.0самая широкая линейка открытых моделей: от крошечных до флаг
GrokxAI62.0M$1.0 — $2.0модели xAI с рекордным окном контекста и доступом к данным с
Perplexity SonarPerplexity5200K$1.0 — $3.0поисковые модели с встроенным retrieval: отвечают со ссылкам
KimiMoonshot AI81.0M$0.47 — $3.0самые крупные модели с открытыми весами: флагман K3 на 2,8 т
MistralMistral AI18262K$0.02 — $2.0европейская линейка с открытыми весами и самым дешёвым флагм
LlamaMeta81.3M$0.03 — $0.4линейка Meta с открытыми весами, остановившаяся на четвёртом
MiniMaxMiniMax91.0M$0.15 — $0.55китайские модели с упором на длинный контекст и работу с вид

Данные каталога OpenRouter на 13.08.2026: цена указана за миллион токенов, отдельно за входные и выходные. У вендора напрямую цена та же.

Российские модели: цены в рублях

семействомоделеймакс. контекстцена за 1K входных, ₽чем известно
GigaChatСбер4128K0 ₽ — 0 ₽линейка Сбера: флагман 3.5 Ultra на 432 млрд параметров с от
YandexGPTЯндекс5128K0,1 ₽ — 1,2 ₽модели Яндекса в AI Studio: оплата в рублях, прямой доступ и

Вынесены отдельно, потому что тарифицируются в другой валюте и за другой объём: рубли за тысячу токенов против долларов за миллион. Сравнивать колонки между таблицами напрямую нельзя. Обе линейки доступны из России без посредника и оплачиваются российской картой.

Кто удерживает больше всего текста

Окно контекста определяет, сколько материала можно дать модели за один раз: документ, репозиторий, переписку. Миллион токенов — это примерно семьсот тысяч слов, то есть восемь томов «Войны и мира».

Практический предел ниже заявленного: чем длиннее контекст, тем хуже модель удерживает детали в его середине. Полное окно имеет смысл для поиска по тексту, а не для рассуждения по всему объёму сразу.

листайте схему вбок

Сколько текста модель удерживает за разокно контекста в токенах · 1M токенов ≈ 700 тысяч словGrok 4.20 Multi-Agent2.0MGrok 4.202.0MLlama 4 Scout1.3MGPT-5.6 Luna Pro1.1MGPT-5.6 Luna Pro (batch)1.1MGPT-5.6 Luna1.1M
Рекорд держат модели xAI с двумя миллионами токенов. У флагманов Anthropic и OpenAI окно меньше, но качество удержания деталей выше.

Сколько стоит миллион токенов

Цена считается отдельно за отправленное и полученное, причём выход обычно дороже входа в три-пять раз. Это меняет расчёт: длинный ответ стоит дороже длинного вопроса.

Разброс по рынку — от нескольких центов до полутора сотен долларов за миллион входных токенов. Разница между самой дешёвой и самой дорогой моделью — тысячи раз.

листайте схему вбок

Разброс цен внутри семейств$ за 1M входных токенов · логарифмическая шкалаClaude0.25 — 30.0GPT0.02 — 150.0Gemini0.05 — 2.0DeepSeek0.08 — 1.17Qwen0.03 — 2.0Grok1.0 — 2.0Perplexity Sonar1.0 — 3.0Kimi0.47 — 3.0Mistral0.02 — 2.0Llama0.03 — 0.4MiniMax0.15 — 0.55GigaChat0 — 0YandexGPT0.1 — 1.2
У каждого вендора есть и дешёвые модели, и флагманы. Выбирать стоит не семейство, а конкретную модель под задачу.

Самые дешёвые модели каталога

модельконтекствход $/1Mвыход $/1M
GPT-5 Nano (batch)400K$0.02$0.2
Mistral Nemo131K$0.02$0.03
gpt-oss-120b131K$0.03$0.17
gpt-oss-20b131K$0.03$0.13
Qwen3.7 Flash1.0M$0.03$0.13
Llama 3.2 1B Instruct60K$0.03$0.2

На простых операциях — классификация, извлечение данных, короткие ответы — разница в качестве с флагманами почти незаметна, а счёт отличается в десятки раз.

Как выбрать модель под задачу

Три вопроса закрывают выбор в большинстве случаев.

Сколько текста нужно отдать за раз

Если работа идёт с длинными документами или кодовой базой, окно контекста важнее цены: модель с маленьким окном просто не увидит материал целиком.

Нужно ли рассуждение

Модели с режимом рассуждения тратят токены на внутренние размышления и потому дороже. На простых задачах это выброшенные деньги, на сложных — единственный способ получить верный ответ.

Какой объём операций

Для потока однотипных запросов дешёвая модель экономит кратно. Для десятка задач в день разница в цене несущественна — берите лучшую.

Частые вопросы

Почему цены указаны за миллион токенов
Так их указывают вендоры. Миллион токенов — это примерно 700 тысяч слов: объём, на котором удобно сравнивать модели между собой.
Чем вход отличается от выхода
Вход — то, что вы отправили: промпт, история, документы. Выход — ответ модели. Выход тарифицируется дороже, обычно в три-пять раз.
Модель с большим контекстом всегда лучше
Нет. На длинных контекстах модели хуже удерживают детали в середине. Большое окно полезно для поиска по тексту, а не для рассуждения по всему объёму.
Можно ли пользоваться всеми моделями по одному ключу
Да, через шлюз: один ключ и один баланс открывают доступ ко всему каталогу.
Как часто обновляются данные
Цены и список моделей берутся из каталога шлюза при обновлении страницы. Дата проверки указана внизу.
Почему у одной модели несколько вариантов в каталоге
Разные провайдеры раздают одну модель с разной ценой, скоростью и лимитами. Через шлюз можно закрепить конкретного.

Связанные страницы

Последняя проверка фактов: 16.08.2026. Нашли неточность — напишите редакции.