Модели ИИ: каталог с ценами, контекстом и сравнением
В каталоге больше трёхсот моделей, и выбирать между ними по названию бессмысленно. Здесь они собраны в таблицы по двум параметрам, которые реально определяют выбор: сколько текста модель удерживает за раз и сколько стоит миллион токенов.

Семейства моделей: что есть на рынке
13 вендоров, у каждого своя линейка от лёгких моделей до флагманов. Разброс цен внутри одного семейства достигает сотни раз — поэтому «дорогой Claude» и «дешёвый Qwen» некорректное сравнение: у обоих есть и то, и другое.
| семейство | моделей | макс. контекст | цена за 1M входных, $ | чем известно |
|---|---|---|---|---|
| ClaudeAnthropic | 28 | 1.0M | $0.25 — $30.0 | модели Anthropic: Opus для сложных задач, Sonnet для повседн |
| GPTOpenAI | 94 | 1.1M | $0.02 — $150.0 | линейка OpenAI: универсальные модели, рассуждение, генерация |
| GeminiGoogle | 39 | 1.0M | $0.05 — $2.0 | модели Google с сильной мультимодальностью и большим окном к |
| DeepSeekDeepSeek | 13 | 1.0M | $0.08 — $1.17 | китайские модели с открытыми весами и очень низкой ценой за |
| QwenAlibaba | 50 | 1.0M | $0.03 — $2.0 | самая широкая линейка открытых моделей: от крошечных до флаг |
| GrokxAI | 6 | 2.0M | $1.0 — $2.0 | модели xAI с рекордным окном контекста и доступом к данным с |
| Perplexity SonarPerplexity | 5 | 200K | $1.0 — $3.0 | поисковые модели с встроенным retrieval: отвечают со ссылкам |
| KimiMoonshot AI | 8 | 1.0M | $0.47 — $3.0 | самые крупные модели с открытыми весами: флагман K3 на 2,8 т |
| MistralMistral AI | 18 | 262K | $0.02 — $2.0 | европейская линейка с открытыми весами и самым дешёвым флагм |
| LlamaMeta | 8 | 1.3M | $0.03 — $0.4 | линейка Meta с открытыми весами, остановившаяся на четвёртом |
| MiniMaxMiniMax | 9 | 1.0M | $0.15 — $0.55 | китайские модели с упором на длинный контекст и работу с вид |
Данные каталога OpenRouter на 13.08.2026: цена указана за миллион токенов, отдельно за входные и выходные. У вендора напрямую цена та же.
Российские модели: цены в рублях
| семейство | моделей | макс. контекст | цена за 1K входных, ₽ | чем известно |
|---|---|---|---|---|
| GigaChatСбер | 4 | 128K | 0 ₽ — 0 ₽ | линейка Сбера: флагман 3.5 Ultra на 432 млрд параметров с от |
| YandexGPTЯндекс | 5 | 128K | 0,1 ₽ — 1,2 ₽ | модели Яндекса в AI Studio: оплата в рублях, прямой доступ и |
Вынесены отдельно, потому что тарифицируются в другой валюте и за другой объём: рубли за тысячу токенов против долларов за миллион. Сравнивать колонки между таблицами напрямую нельзя. Обе линейки доступны из России без посредника и оплачиваются российской картой.
Кто удерживает больше всего текста
Окно контекста определяет, сколько материала можно дать модели за один раз: документ, репозиторий, переписку. Миллион токенов — это примерно семьсот тысяч слов, то есть восемь томов «Войны и мира».
Практический предел ниже заявленного: чем длиннее контекст, тем хуже модель удерживает детали в его середине. Полное окно имеет смысл для поиска по тексту, а не для рассуждения по всему объёму сразу.
листайте схему вбок
Сколько стоит миллион токенов
Цена считается отдельно за отправленное и полученное, причём выход обычно дороже входа в три-пять раз. Это меняет расчёт: длинный ответ стоит дороже длинного вопроса.
Разброс по рынку — от нескольких центов до полутора сотен долларов за миллион входных токенов. Разница между самой дешёвой и самой дорогой моделью — тысячи раз.
листайте схему вбок
Самые дешёвые модели каталога
| модель | контекст | вход $/1M | выход $/1M |
|---|---|---|---|
| GPT-5 Nano (batch) | 400K | $0.02 | $0.2 |
| Mistral Nemo | 131K | $0.02 | $0.03 |
| gpt-oss-120b | 131K | $0.03 | $0.17 |
| gpt-oss-20b | 131K | $0.03 | $0.13 |
| Qwen3.7 Flash | 1.0M | $0.03 | $0.13 |
| Llama 3.2 1B Instruct | 60K | $0.03 | $0.2 |
На простых операциях — классификация, извлечение данных, короткие ответы — разница в качестве с флагманами почти незаметна, а счёт отличается в десятки раз.
Как выбрать модель под задачу
Три вопроса закрывают выбор в большинстве случаев.
Сколько текста нужно отдать за раз
Если работа идёт с длинными документами или кодовой базой, окно контекста важнее цены: модель с маленьким окном просто не увидит материал целиком.
Нужно ли рассуждение
Модели с режимом рассуждения тратят токены на внутренние размышления и потому дороже. На простых задачах это выброшенные деньги, на сложных — единственный способ получить верный ответ.
Какой объём операций
Для потока однотипных запросов дешёвая модель экономит кратно. Для десятка задач в день разница в цене несущественна — берите лучшую.
Частые вопросы
Почему цены указаны за миллион токенов
Чем вход отличается от выхода
Модель с большим контекстом всегда лучше
Можно ли пользоваться всеми моделями по одному ключу
Как часто обновляются данные
Почему у одной модели несколько вариантов в каталоге
Связанные страницы
- Справочник по искусственному интеллекту на русском
- Доступ и оплата ИИ-сервисов из России: все способы и цены
- Инструменты для работы с ИИ: каталог с ценами и порогом входа
- GPT: модели, контекст, цены и доступ из России
- Claude: модели, контекст, цены и доступ из России
- DeepSeek: модели, контекст, цены и доступ из России
- Gemini: модели, контекст, цены и доступ из России
- GigaChat: модели, контекст, цены и доступ из России
Последняя проверка фактов: 16.08.2026. Нашли неточность — напишите редакции.