Новый флагман OpenAI: GPT-6 Astra. Самая сильная модель линейки для сложных рассуждений, программирования и агентных задач. Контекст 1M токенов.
gpt-6-astra41 моделей по одному ключу. Единая цена за 1M токенов — вход и выход стоят одинаково, списание по факту.
Новый флагман OpenAI: GPT-6 Astra. Самая сильная модель линейки для сложных рассуждений, программирования и агентных задач. Контекст 1M токенов.
gpt-6-astraНовейшая быстрая модель Google с режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.
gemini-3.8-flashКрупная модель рассуждений Z.ai для сложной разработки и долгих агентных задач: контекст 1M токенов, до 131K выхода. Рассуждения включены всегда (low / high / max, по умолчанию max), улучшена экономия токенов относительно GLM-5.2.
glm-5.3Быстрая и недорогая версия GLM 5.3: тот же контекст 1M токенов и до 131K выхода, но заметно дешевле и с меньшей задержкой. Подходит для высоконагруженных агентных сценариев, автодополнения кода и массовой обработки текста.
glm-5.3-flashБыстрая Antigravity-модель Google с отдельными режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.
gemini-3.7-flashСамая сильная модель xAI: фронтир-результаты в коде, knowledge work и STEM. Принимает текст, изображения и файлы (в том числе PDF), контекст 500K токенов. Активно используется в агентных инструментах для разработки.
grok-4.6Крупная MoE-модель DeepSeek, общедоступный релиз V4 Pro. Контекст 1M токенов, раздаётся как самим DeepSeek, так и сторонними провайдерами инференса; сильные результаты в рассуждениях, коде и агентных бенчмарках.
deepseek-v4-proОткрытая лёгкая MoE-модель: 3B активных параметров из 30B общих, рассчитана на высокую пропускную способность в агентных нагрузках и дообучение под домен. Контекст 1M токенов, часть семейства открытых моделей NVIDIA для агентного ИИ.
nemotron-3.5-lightningФлагман серии Qwen3.8 от Alibaba: мультимодальная модель рассуждений для сложных задач, визуального понимания, кода и агентных сценариев. Контекст 1M токенов, высокие места в индексах Artificial Analysis по интеллекту, коду и агентности.
qwen3.8-maxОткрытая нативно-мультимодальная модель Moonshot AI с 2,8 трлн параметров — первая открытая модель класса 3T. Построена на Kimi Delta Attention и Attention Residuals, контекст 1M токенов; рассчитана на долгие задачи в коде, knowledge work и рассуждения.
kimi-k3Флагман серии GPT-5.6: сложные рассуждения, программирование и агентные сценарии. Особенно силён в многошаговых задачах в терминале и длинных цепочках работы с кодом. Контекст 1M токенов, знание мира до февраля 2026.
gpt-5.6-solСбалансированная модель серии GPT-5.6 между флагманским Sol и экономичным Luna. Рассчитана на повседневное программирование, рассуждения и агентные задачи примерно вдвое дешевле Sol. Контекст 1M токенов.
gpt-5.6-terraСамый быстрый и дешёвый уровень семейства GPT-5.6 для высоконагруженных сценариев. Поддерживает управление режимом рассуждений и кэширование промпта, как и старшие модели серии.
gpt-5.6-lunaФронтир-модель xAI с сильными результатами в коде, knowledge work и STEM. Контекст 500K токенов, поддерживает пошаговые рассуждения. Широко применяется в ассистентах по коду и автономных агентных фреймворках.
grok-4.5Новая быстрая Antigravity-модель Google с отдельными режимами рассуждения low, medium и high, мультимодальным входом и контекстом 1M токенов.
gemini-3.6-flashСамая агентная модель линейки Sonnet: сокращает разрыв с Opus 4.8 в рассуждениях, работе с инструментами и коде при заметно меньшей цене. Реже галлюцинирует и подстраивается под пользователя, чем Sonnet 4.6.
claude-sonnet-5Кодовая модель семейства Kimi K2 на базе K2.6: MoE на 1 трлн параметров, 32B активных (384 эксперта, 8 на токен) и визуальный энкодер MoonViT. Контекст 262K, всегда работает в режиме рассуждений с сохранением цепочки между ходами.
kimi-k2.7-codeОткрытая фронтир-модель рассуждений и оркестрации: 550B параметров, 55B активных, гибридная архитектура Transformer-Mamba MoE с LatentMoE и нативным спекулятивным декодированием через MTP. Контекст до 1M токенов, заточена под долгие агентные воркфлоу.
nemotron-3-ultraЭкономичная модель серии Qwen3.7 с вводом текста и изображений. Существенно усилено зрение при сохранении агентного интеллекта: распознаёт сцены, читает интерфейсы, генерирует код по визуальным образцам и умеет ходить по мобильным приложениям.
qwen3.7-plusМультимодальная модель MiniMax: текст, изображения и видео на входе, контекст 1M токенов. Построена на MiniMax Sparse Attention с выбором KV-блоков вместо полного внимания — примерно в 20 раз меньше вычислений на токен на длинном контексте.
minimax-m3Развитие Opus 4.7: лучше код, надёжнее агентные прогоны, примерно в 4 раза реже пропускает ошибочный код без замечаний. Появились пользовательские настройки усилия и «динамические воркфлоу» Claude Code с параллельными субагентами.
claude-opus-4-8Флагман серии Qwen3.7: только текст на входе и выходе, контекст 1M токенов. Ориентирован на агентные нагрузки — программирование, офисные задачи и длительное автономное выполнение, с поддержкой кэширования промпта.
qwen3.7-maxСобственная агентная модель Cursor для разработки, обученная на чекпоинте Moonshot Kimi K2.5 с дополнительным RL на длинных задачах. Вариант Fast — интерактивный режим по умолчанию, настроен на работу с инструментами, многофайловые правки и терминал.
composer-2.5-fastБыстрая модель Google хорошего уровня: достойная точность, высокая скорость и контекст 1M токенов. Проще версии Pro, зато быстрее отвечает и обходится дешевле.
gemini-3.5-flashФлагман OpenAI весны 2026: самая агентная модель линейки на момент выхода, 82,7% на Terminal-Bench 2.0, сильна в работе с компьютером и knowledge work. При той же скорости на токен, что GPT-5.4, тратит меньше токенов на эквивалентные задачи Codex.
gpt-5.5Экономичная MoE-модель DeepSeek: 284B параметров, 13B активных, гибридное внимание для дешёвой работы с длинным контекстом до 1M токенов. Поддерживает усилия рассуждений high и xhigh, подходит для быстрых ассистентов и массовых агентных сценариев.
deepseek-v4-flashФлагманская агентная модель Xiaomi на триллион параметров: сильные результаты на ClawEval, GDPVal и SWE-bench Pro. Способна автономно держать связное выполнение почти на 1000 вызовов инструментов, контекст до 1M токенов и до 128K выхода.
mimo-v2.5-proНативно омнимодальная модель Xiaomi: агентная производительность уровня Pro примерно за половину стоимости инференса, лучше MiMo-V2-Omni в понимании изображений и видео. Контекст 1M токенов вмещает целые документы и длинные диалоги.
mimo-v2.5Быстрая и экономичная версия GPT-5.4 для высокой пропускной способности. Поддерживает текст и изображения, уверенно работает с инструментами — подходит для чат-приложений, ассистентов по коду и массовых агентных сценариев.
gpt-5.4-miniМодель Z.ai для быстрого инференса в агентных средах с длинными цепочками выполнения. Контекст 203K, улучшены декомпозиция сложных инструкций, работа с инструментами и стабильность на длинных прогонах.
glm-5-turboСильная универсальная модель Google высокого уровня: высокая точность, глубокие рассуждения и контекст 1M токенов. Принимает текст, изображения, аудио, видео и PDF, отвечает текстом.
gemini-3.1-proМодель, объединившая линии Codex и GPT в одну систему: 922K входного контекста и до 128K выхода, ввод текста и изображений. Улучшены программирование, понимание документов, работа с инструментами и следование инструкциям.
gpt-5.4Первая модель класса Opus с контекстом 1M токенов (в бете): аккуратнее планирует и дольше держит агентные задачи в больших кодовых базах. На момент выхода — SOTA на Terminal-Bench 2.0 и Humanity's Last Exam.
claude-opus-4-6Модель распознавания речи OpenAI: принимает аудиофайл на вход и возвращает текст через маршрут /v1/audio/transcriptions. Подходит для расшифровки звонков, интервью и голосовых сообщений.
gpt-4o-transcribeМодель Anthropic верхнего ценового уровня ($10 / $50 за 1M у вендора) — тот же тариф, что у Claude Mythos 5 ограниченной доступности. Выпущена с более строгими мерами кибербезопасности, чем последующие модели Sonnet.
claude-fable-5Флагман класса Opus: $5 / $25 за 1M у вендора — тот же тариф, что у Opus 4.5–4.8. Claude Sonnet 5 по отчётам подбирается к уровню Opus 5, что делает последний ориентиром максимальной точности в линейке.
claude-opus-5Модель класса Opus, предшественник Opus 4.8, тариф вендора $5 / $25 за 1M. Использовалась как базовая точка сравнения в бенчмарках по коду, работе с компьютером и юридическим агентам.
claude-opus-4-7Предшественник Claude Sonnet 5 с тарифом вендора $3 / $15 за 1M. Служил базой сравнения, относительно которой Sonnet 5 показал прирост в агентных рассуждениях, работе с инструментами, коде и безопасности.
claude-sonnet-4-6Быстрая недорогая модель Anthropic, тариф вендора $1 / $5 за 1M. Часть поколения Claude 4.5, в котором появились региональные и мультирегиональные эндпоинты в Bedrock и Google Cloud.
claude-haiku-4-5Модель рассуждений Z.ai с контекстом 1M токенов для долгих агентных сценариев, проектной разработки и многошаговой автоматизации. Поддерживает усилия рассуждений high и xhigh (xhigh соответствует максимуму).
glm-5.2Лёгкая и очень дешёвая модель для массовых задач: классификация, извлечение данных, короткие ответы и высоконагруженные сценарии с минимальной стоимостью токена.
muse-spark-1.2У каждой модели одна цена за 1M токенов — вход и выход стоят одинаково, списание идёт по факту запроса, без подписок и минимальных платежей. Считается пропорционально: 100K токенов — десятая часть указанной суммы. Рублёвые значения показаны по внутреннему курсу 100 ₽ за $1.