Модели

41 моделей по одному ключу. Единая цена за 1M токенов — вход и выход стоят одинаково, списание по факту.

Модальности
ТекстИзображенияАудиоВидеоPDFТекст
1M контекст
НоваяФлагман

Новый флагман OpenAI: GPT-6 Astra. Самая сильная модель линейки для сложных рассуждений, программирования и агентных задач. Контекст 1M токенов.

by openai|5 сен 2026|1M контекст|$0.489/M вход|$0.489/M выход|gpt-6-astra
1M контекст
БыстраяПрограммированиеlowmediumhigh

Новейшая быстрая модель Google с режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.

by google|2 сен 2026|1M контекст|$0.075/M вход|$0.075/M выход|gemini-3.8-flash

Z.ai: GLM 5.3

Reasoning
1,05M контекст
Программирование

Крупная модель рассуждений Z.ai для сложной разработки и долгих агентных задач: контекст 1M токенов, до 131K выхода. Рассуждения включены всегда (low / high / max, по умолчанию max), улучшена экономия токенов относительно GLM-5.2.

by z-ai|18 авг 2026|1,05M контекст|$0.143/M вход|$0.143/M выход|glm-5.3
1,05M контекст
БыстраяПрограммирование

Быстрая и недорогая версия GLM 5.3: тот же контекст 1M токенов и до 131K выхода, но заметно дешевле и с меньшей задержкой. Подходит для высоконагруженных агентных сценариев, автодополнения кода и массовой обработки текста.

by z-ai|18 авг 2026|1,05M контекст|$0.045/M вход|$0.045/M выход|glm-5.3-flash
1M контекст
БыстраяПрограммированиеlowmediumhigh

Быстрая Antigravity-модель Google с отдельными режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.

by google|14 авг 2026|1M контекст|$0.075/M вход|$0.075/M выход|gemini-3.7-flash

xAI: Grok 4.6

Reasoning
500K контекст
STEM

Самая сильная модель xAI: фронтир-результаты в коде, knowledge work и STEM. Принимает текст, изображения и файлы (в том числе PDF), контекст 500K токенов. Активно используется в агентных инструментах для разработки.

by x-ai|12 авг 2026|500K контекст|$0.060/M вход|$0.060/M выход|grok-4.6
1M контекст

Крупная MoE-модель DeepSeek, общедоступный релиз V4 Pro. Контекст 1M токенов, раздаётся как самим DeepSeek, так и сторонними провайдерами инференса; сильные результаты в рассуждениях, коде и агентных бенчмарках.

by deepseek|12 авг 2026|1M контекст|$0.045/M вход|$0.045/M выход|deepseek-v4-pro
Дешёваяlowmediumhigh

Открытая лёгкая MoE-модель: 3B активных параметров из 30B общих, рассчитана на высокую пропускную способность в агентных нагрузках и дообучение под домен. Контекст 1M токенов, часть семейства открытых моделей NVIDIA для агентного ИИ.

by nvidia|11 авг 2026|1M контекст|$0.0038/M вход|$0.0038/M выход|nemotron-3.5-lightning
1M контекст
Мультимодальная

Флагман серии Qwen3.8 от Alibaba: мультимодальная модель рассуждений для сложных задач, визуального понимания, кода и агентных сценариев. Контекст 1M токенов, высокие места в индексах Artificial Analysis по интеллекту, коду и агентности.

by qwen|3 авг 2026|1M контекст|$0.023/M вход|$0.023/M выход|qwen3.8-max
1M контекст
Open weights

Открытая нативно-мультимодальная модель Moonshot AI с 2,8 трлн параметров — первая открытая модель класса 3T. Построена на Kimi Delta Attention и Attention Residuals, контекст 1M токенов; рассчитана на долгие задачи в коде, knowledge work и рассуждения.

by moonshotai|17 июл 2026|1M контекст|$0.414/M вход|$0.414/M выход|kimi-k3
1M контекст
ПрограммированиеАгенты

Флагман серии GPT-5.6: сложные рассуждения, программирование и агентные сценарии. Особенно силён в многошаговых задачах в терминале и длинных цепочках работы с кодом. Контекст 1M токенов, знание мира до февраля 2026.

by openai|9 июл 2026|1M контекст|$0.188/M вход|$0.188/M выход|gpt-5.6-sol
1M контекст
Баланс

Сбалансированная модель серии GPT-5.6 между флагманским Sol и экономичным Luna. Рассчитана на повседневное программирование, рассуждения и агентные задачи примерно вдвое дешевле Sol. Контекст 1M токенов.

by openai|9 июл 2026|1M контекст|$0.090/M вход|$0.090/M выход|gpt-5.6-terra
1M контекст
Быстрая

Самый быстрый и дешёвый уровень семейства GPT-5.6 для высоконагруженных сценариев. Поддерживает управление режимом рассуждений и кэширование промпта, как и старшие модели серии.

by openai|9 июл 2026|1M контекст|$0.017/M вход|$0.017/M выход|gpt-5.6-luna

xAI: Grok 4.5

Reasoning
500K контекст

Фронтир-модель xAI с сильными результатами в коде, knowledge work и STEM. Контекст 500K токенов, поддерживает пошаговые рассуждения. Широко применяется в ассистентах по коду и автономных агентных фреймворках.

by x-ai|8 июл 2026|500K контекст|$0.060/M вход|$0.060/M выход|grok-4.5
1M контекст
БыстраяПрограммированиеlowmediumhigh

Новая быстрая Antigravity-модель Google с отдельными режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.

by google|2 июл 2026|1M контекст|$0.075/M вход|$0.075/M выход|gemini-3.6-flash
1M контекст
Популярная

Самая агентная модель линейки Sonnet: сокращает разрыв с Opus 4.8 в рассуждениях, работе с инструментами и коде при заметно меньшей цене. Реже галлюцинирует и подстраивается под пользователя, чем Sonnet 4.6.

by anthropic|30 июн 2026|1M контекст|$0.150/M вход|$0.150/M выход|claude-sonnet-5
262K контекст
Программирование

Кодовая модель семейства Kimi K2 на базе K2.6: MoE на 1 трлн параметров, 32B активных (384 эксперта, 8 на токен) и визуальный энкодер MoonViT. Контекст 262K, всегда работает в режиме рассуждений с сохранением цепочки между ходами.

by moonshotai|12 июн 2026|262K контекст|$0.113/M вход|$0.113/M выход|kimi-k2.7-code
1M контекст
Open weights

Открытая фронтир-модель рассуждений и оркестрации: 550B параметров, 55B активных, гибридная архитектура Transformer-Mamba MoE с LatentMoE и нативным спекулятивным декодированием через MTP. Контекст до 1M токенов, заточена под долгие агентные воркфлоу.

by nvidia|4 июн 2026|1M контекст|$0.0038/M вход|$0.0038/M выход|nemotron-3-ultra
1M контекст
Дешёвая

Экономичная модель серии Qwen3.7 с вводом текста и изображений. Существенно усилено зрение при сохранении агентного интеллекта: распознаёт сцены, читает интерфейсы, генерирует код по визуальным образцам и умеет ходить по мобильным приложениям.

by qwen|3 июн 2026|1M контекст|$0.0075/M вход|$0.0075/M выход|qwen3.7-plus
1M контекст
Мультимодальная

Мультимодальная модель MiniMax: текст, изображения и видео на входе, контекст 1M токенов. Построена на MiniMax Sparse Attention с выбором KV-блоков вместо полного внимания — примерно в 20 раз меньше вычислений на токен на длинном контексте.

by minimax|31 мая 2026|1M контекст|$0.034/M вход|$0.034/M выход|minimax-m3
1M контекст
Программирование

Развитие Opus 4.7: лучше код, надёжнее агентные прогоны, примерно в 4 раза реже пропускает ошибочный код без замечаний. Появились пользовательские настройки усилия и «динамические воркфлоу» Claude Code с параллельными субагентами.

by anthropic|28 мая 2026|1M контекст|$0.301/M вход|$0.301/M выход|claude-opus-4-8
1M контекст

Флагман серии Qwen3.7: только текст на входе и выходе, контекст 1M токенов. Ориентирован на агентные нагрузки — программирование, офисные задачи и длительное автономное выполнение, с поддержкой кэширования промпта.

by qwen|21 мая 2026|1M контекст|$0.015/M вход|$0.015/M выход|qwen3.7-max
256K контекст
Программирование

Собственная агентная модель Cursor для разработки, обученная на чекпоинте Moonshot Kimi K2.5 с дополнительным RL на длинных задачах. Вариант Fast — интерактивный режим по умолчанию, настроен на работу с инструментами, многофайловые правки и терминал.

by cursor|18 мая 2026|256K контекст|$0.038/M вход|$0.038/M выход|composer-2.5-fast
1M контекст
БыстраяМультимодальнаяlowmediumhigh

Быстрая модель Google хорошего уровня: достойная точность, высокая скорость и контекст 1M токенов. Проще версии Pro, зато быстрее отвечает и обходится дешевле.

by google|6 мая 2026|1M контекст|$0.075/M вход|$0.075/M выход|gemini-3.5-flash
400K контекст
Агенты

Флагман OpenAI весны 2026: самая агентная модель линейки на момент выхода, 82,7% на Terminal-Bench 2.0, сильна в работе с компьютером и knowledge work. При той же скорости на токен, что GPT-5.4, тратит меньше токенов на эквивалентные задачи Codex.

by openai|23 апр 2026|400K контекст|$0.188/M вход|$0.188/M выход|gpt-5.5
1M контекст
Дешёвая

Экономичная MoE-модель DeepSeek: 284B параметров, 13B активных, гибридное внимание для дешёвой работы с длинным контекстом до 1M токенов. Поддерживает усилия рассуждений high и xhigh, подходит для быстрых ассистентов и массовых агентных сценариев.

by deepseek|23 апр 2026|1M контекст|$0.0075/M вход|$0.0075/M выход|deepseek-v4-flash
1M контекст
Агенты

Флагманская агентная модель Xiaomi на триллион параметров: сильные результаты на ClawEval, GDPVal и SWE-bench Pro. Способна автономно держать связное выполнение почти на 1000 вызовов инструментов, контекст до 1M токенов и до 128K выхода.

by xiaomi|22 апр 2026|1M контекст|$0.023/M вход|$0.023/M выход|mimo-v2.5-pro
1M контекст
Дешёвая

Нативно омнимодальная модель Xiaomi: агентная производительность уровня Pro примерно за половину стоимости инференса, лучше MiMo-V2-Omni в понимании изображений и видео. Контекст 1M токенов вмещает целые документы и длинные диалоги.

by xiaomi|22 апр 2026|1M контекст|$0.0038/M вход|$0.0038/M выход|mimo-v2.5
400K контекст

Быстрая и экономичная версия GPT-5.4 для высокой пропускной способности. Поддерживает текст и изображения, уверенно работает с инструментами — подходит для чат-приложений, ассистентов по коду и массовых агентных сценариев.

by openai|17 мар 2026|400K контекст|$0.060/M вход|$0.060/M выход|gpt-5.4-mini
203K контекст
Быстрая

Модель Z.ai для быстрого инференса в агентных средах с длинными цепочками выполнения. Контекст 203K, улучшены декомпозиция сложных инструкций, работа с инструментами и стабильность на длинных прогонах.

by z-ai|15 мар 2026|203K контекст|$0.104/M вход|$0.104/M выход|glm-5-turbo
1M контекст
МультимодальнаяРассужденияlowhigh

Сильная универсальная модель Google высокого уровня: высокая точность, глубокие рассуждения и контекст 1M токенов. Принимает текст, изображения, аудио, видео и PDF, отвечает текстом.

by google|10 мар 2026|1M контекст|$0.150/M вход|$0.150/M выход|gemini-3.1-pro
1M контекст

Модель, объединившая линии Codex и GPT в одну систему: 922K входного контекста и до 128K выхода, ввод текста и изображений. Улучшены программирование, понимание документов, работа с инструментами и следование инструкциям.

by openai|5 мар 2026|1M контекст|$0.113/M вход|$0.113/M выход|gpt-5.4
1M контекст

Первая модель класса Opus с контекстом 1M токенов (в бете): аккуратнее планирует и дольше держит агентные задачи в больших кодовых базах. На момент выхода — SOTA на Terminal-Bench 2.0 и Humanity's Last Exam.

by anthropic|5 фев 2026|1M контекст|$0.301/M вход|$0.301/M выход|claude-opus-4-6
16K контекст
Аудио

Модель распознавания речи OpenAI: принимает аудиофайл на вход и возвращает текст через маршрут /v1/audio/transcriptions. Подходит для расшифровки звонков, интервью и голосовых сообщений.

by openai|20 мар 2025|16K контекст|$0.075/M вход|$0.075/M выход|gpt-4o-transcribe
200K контекст
Топ-уровень

Модель Anthropic верхнего ценового уровня ($10 / $50 за 1M у вендора) — тот же тариф, что у Claude Mythos 5 ограниченной доступности. Выпущена с более строгими мерами кибербезопасности, чем последующие модели Sonnet.

by anthropic|200K контекст|$0.602/M вход|$0.602/M выход|claude-fable-5
1M контекст
Флагман

Флагман класса Opus: $5 / $25 за 1M у вендора — тот же тариф, что у Opus 4.5–4.8. Claude Sonnet 5 по отчётам подбирается к уровню Opus 5, что делает последний ориентиром максимальной точности в линейке.

by anthropic|1M контекст|$0.301/M вход|$0.301/M выход|claude-opus-5
1M контекст

Модель класса Opus, предшественник Opus 4.8, тариф вендора $5 / $25 за 1M. Использовалась как базовая точка сравнения в бенчмарках по коду, работе с компьютером и юридическим агентам.

by anthropic|1M контекст|$0.301/M вход|$0.301/M выход|claude-opus-4-7
1M контекст

Предшественник Claude Sonnet 5 с тарифом вендора $3 / $15 за 1M. Служил базой сравнения, относительно которой Sonnet 5 показал прирост в агентных рассуждениях, работе с инструментами, коде и безопасности.

by anthropic|1M контекст|$0.150/M вход|$0.150/M выход|claude-sonnet-4-6
200K контекст
Быстрая

Быстрая недорогая модель Anthropic, тариф вендора $1 / $5 за 1M. Часть поколения Claude 4.5, в котором появились региональные и мультирегиональные эндпоинты в Bedrock и Google Cloud.

by anthropic|200K контекст|$0.068/M вход|$0.068/M выход|claude-haiku-4-5

Z.ai: GLM 5.2

Reasoning
1M контекст

Модель рассуждений Z.ai с контекстом 1M токенов для долгих агентных сценариев, проектной разработки и многошаговой автоматизации. Поддерживает усилия рассуждений high и xhigh (xhigh соответствует максимуму).

by z-ai|1M контекст|$0.143/M вход|$0.143/M выход|glm-5.2
mu256K контекст
Дешёвая

Лёгкая и очень дешёвая модель для массовых задач: классификация, извлечение данных, короткие ответы и высоконагруженные сценарии с минимальной стоимостью токена.

by muse|256K контекст|$0.0038/M вход|$0.0038/M выход|muse-spark-1.2

У каждой модели одна цена за 1M токенов — вход и выход стоят одинаково, списание идёт по факту запроса, без подписок и минимальных платежей. Считается пропорционально: 100K токенов — десятая часть указанной суммы. Рублёвые значения показаны по внутреннему курсу 100 ₽ за $1.