Models

Изучайте цены, возможности, конечные точки и покрытие поставщиков ИИ-моделей в одном производственном каталоге.

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max — это флагманская модель MoE с 2,4 триллиона параметров, предназначенная для расширенного мышления, программирования и корпоративной производительности. Он может автономно выполнять сложные длительные задачи — от разработки программного обеспечения до профессиональных рабочих процессов, обеспечивая результаты производственного уровня в таких областях, как право, финансы и дизайн. Благодаря встроенному мультимодальному интеллекту Qwen3.8-Max понимает текст, изображения и видео в длинных контекстах, поддерживая глубокий анализ обширных документов и длинного контента. Его агентные возможности обеспечивают автономное планирование, выполнение, проверку и непрерывную итерацию на протяжении сложных рабочих процессов.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

3 авг. 2026 г.

Вход$2 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.25 / млн токенов

Moonshot

Kimi K3

kimi-k3

Kimi K3 — это высокопроизводительная модель ИИ, предназначенная для расширенных рассуждений, программирования и выполнения сложных задач. Она демонстрирует высокую эффективность в крупномасштабных проектах разработки, многошаговом решении проблем и приложениях с интенсивным использованием знаний. Благодаря широкой обработке контекста и мультимодальным возможностям, K3 подходит для создания мощных ИИ-агентов, инструментов разработчика и корпоративных приложений.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

16 июл. 2026 г.

Вход$2.8571 / млн токенов
Выход$14.2857 / млн токенов
Чтение кэша$0.2857 / млн токенов

OpenAI

GPT-5.6 Sol

gpt-5.6-sol

GPT-5.6 Sol — это стандартная версия серии Sol. Она подходит для общих вопросов и ответов, обработки текста, создания черновиков контента, реферирования, легкой помощи в написании кода и задач автоматизации бизнеса. Sol разработана для сценариев, где необходимы надежные общие способности при сохранении эффективности отклика и контроле затрат. Ее можно использовать для функций продуктов, чат-ассистентов, инструментов генерации контента, очистки данных, вопросно-ответных систем на базе знаний и пакетной обработки. Для крупномасштабного использования или быстрого прототипирования Sol является гибкой отправной точкой.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$5 / млн токенов
Выход$30 / млн токенов
Чтение кэша$0.5 / млн токенов

OpenAI

GPT-5.6 Sol Pro

gpt-5.6-sol-pro

GPT-5.6 Sol Pro — это Pro-версия серии Sol, разработанная для сложных задач и более качественных результатов. Подходит для продвинутого письма, точных вопросов и ответов, бизнес-рассуждений, генерации кода, структурированного анализа и выполнения многошаговых задач. Sol Pro хорошо подходит для задач, требующих высокой точности, понимания контекста и выполнения инструкций. Может использоваться для создания профессионального контента, ассистентов анализа данных, систем ответов на вопросы на основе знаний, сложных рабочих процессов агентов и внутренних корпоративных ИИ-инструментов.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$5 / млн токенов
Выход$30 / млн токенов
Чтение кэша$0.5 / млн токенов

OpenAI

GPT-5.6 Terra

gpt-5.6-terra

GPT-5.6 Terra — это универсальная версия серии Terra. Она подходит для повседневных диалогов, генерации текста, суммаризации, извлечения информации, легковесных рассуждений и помощи в написании кода. Terra обеспечивает практичный баланс между общими возможностями, скоростью ответа и стоимостью. Её можно использовать для чат-ассистентов, инструментов контента, автоматизации офиса, вопросно-ответных систем по базам знаний и пакетной обработки текстов. Для быстрых итераций или чувствительных к затратам приложений Terra является надёжным вариантом по умолчанию в серии Terra.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$2.5 / млн токенов
Выход$15 / млн токенов
Чтение кэша$0.275 / млн токенов

OpenAI

GPT-5.6 Terra Pro

gpt-5.6-terra-pro

GPT-5.6 Terra Pro — это улучшенная версия серии Terra, разработанная для получения высококачественных результатов при решении сложных задач. Подходит для продвинутых вопросов и ответов, создания глубокого контента, бизнес-анализа, помощи в программировании и многошаговых рассуждений. По сравнению со стандартной версией, Terra Pro лучше подходит для сценариев, требующих повышенной надежности, более полного рассуждения и точного следования инструкциям. Идеально для профессионального написания текстов, обобщения сложной информации, ассистентов на основе знаний, агентов автоматизации и корпоративных приложений ИИ.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$2.5 / млн токенов
Выход$15 / млн токенов
Чтение кэша$0.275 / млн токенов

OpenAI

GPT-5.6 Luna

gpt-5.6-luna

GPT-5.6 Luna — это универсальная версия серии Luna, подходящая для повседневных ИИ-приложений. Может использоваться для чат-вопросов и ответов, переписывания текстов, обобщения, извлечения информации, простых логических выводов, помощи в написании кода и автоматизации офисных задач. Luna — практичный выбор для прототипов, легких бизнес-функций, пакетной обработки контента и типовых сценариев взаимодействия с пользователями. Это хорошая стартовая модель, когда важны скорость, простота и контроль затрат. Для задач, требующих более высокого качества или стабильности результатов, рассмотрите Luna Pro.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$1 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.1 / млн токенов

OpenAI

GPT-5.6 Luna Pro

gpt-5.6-luna-pro

GPT-5.6 Luna Pro — это улучшенная версия серии Luna, предназначенная для более качественных ответов, более стабильного следования инструкциям и более эффективного выполнения задач. Она подходит для сложных диалогов, генерации контента, вопросов и ответов по знаниям, бизнес-анализа, помощи в программировании и многошаговых задач автоматизации. Luna Pro отлично подходит для продуктов, где важны качество вывода и пользовательский опыт, например, профессиональные помощники по написанию, корпоративные ИИ-ассистенты, поддержка клиентов, системы баз знаний и рабочие процессы агентов. Это хороший вариант, когда задача требует большей надёжности, чем стандартная модель Luna.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

9 июл. 2026 г.

Вход$1 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.1 / млн токенов

DeepSeek

DeepSeek V4 Pro

deepseek-v4-pro

DeepSeek V4 Pro в источниках выделяется следующими характеристиками: MoE 1.6T всего / 49B активных, 1M-token контекст, hybrid длинный контекст attention. Основная ценность модели связана с продвинутое рассуждение, программирование, вся кодовая база анализ and долгосрочные агентные рабочие процессы. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

1M

Максимальный вывод

384K

Дата выпуска

24 апр. 2026 г.

Вход$1.2857 / млн токенов
Выход$3.8571 / млн токенов
Чтение кэша$0.0429 / млн токенов

Z.ai

GLM-5.2

glm-5.2

GLM-5.2 — флагманская базовая модель Z.ai для длительных инженерных задач. Она делает акцент на реально используемом контекстном окне в 1M токенов, позволяющем работать с кодовой базой, документацией и системным контекстом на уровне проекта. Модель рассчитана на полный цикл разработки: от требований и анализа репозитория до реализации, тестирования и мультиплатформенного развертывания.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

13 июн. 2026 г.

Вход$1.1429 / млн токенов
Выход$4 / млн токенов
Чтение кэша$0.2857 / млн токенов

DeepSeek

DeepSeek V4 Flash

deepseek-v4-flash

DeepSeek V4 Flash в источниках выделяется следующими характеристиками: MoE 284B всего / 13B активных, 1M-token контекст, инференс, ориентированный на пропускную способность. Основная ценность модели связана с высокий объем производственные вызовы, быстрая длинный контекст обработка and чувствительные к стоимости автоматизация. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

1M

Максимальный вывод

384K

Дата выпуска

24 апр. 2026 г.

Вход$0.4286 / млн токенов
Выход$1.2857 / млн токенов
Чтение кэша$0.0143 / млн токенов

Anthropic

Claude Opus 5

claude-opus-5

Claude Opus 5 — флагманская модель Anthropic для сложных задач рассуждения, программирования и долгосрочной агентной работы. Она особенно сильна в сквозных программных задачах, рецензировании кода и поиске ошибок, визуальном анализе диаграмм и документов, сложных офисных задачах и координации параллельных подмодулей. Модель сохраняет высокую способность следовать инструкциям и использовать инструменты в длительных задачах, оставаясь эффективной при меньших усилиях для рабочих нагрузок, где приоритетны задержка и эффективность токенов.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

24 июл. 2026 г.

Вход$5 / млн токенов
Выход$25 / млн токенов
Чтение кэша$0.5 / млн токенов

Anthropic

Claude Opus 5 Fast

claude-opus-5-fast

Быстрый вариант Opus 5 - идентичные возможности с более высокой скоростью вывода по цене в 2 раза выше обычного Opus 5. Узнайте больше в документации Anthropic: https://platform.claude.com/docs/en/build-with-claude/fast-mode

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

24 июл. 2026 г.

Вход$10 / млн токенов
Выход$50 / млн токенов
Чтение кэша$1 / млн токенов

xAI

Grok 4.6

grok-4.6

Grok 4.6 — это продвинутая модель рассуждений xAI, созданная для сложного программирования, длительных агентных задач и работы со знаниями. Она поддерживает ввод текста и изображений, контекстное окно до 500 тыс. токенов и настраиваемую интенсивность рассуждений: низкую, среднюю, высокую и сверхвысокую. Благодаря вызову функций, поиску в вебе и X, выполнению кода и структурированным выходным данным Grok 4.6 оптимизирована для анализа нескольких кодовых баз, многошаговой работы с инструментами, самопроверки и сквозных инженерных процессов. Это универсальная модель рассуждений и агентного типа, а не просто чат-бот, связанный с платформой X.

Максимальный контекст

500K

Максимальный вывод

500K

Дата выпуска

12 авг. 2026 г.

Вход$2 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.3 / млн токенов

Google

Gemini 3.6 Flash

gemini-3.6-flash

Gemini 3.6 Flash — это высокоэффективная модель от Google для программирования, агентных рабочих процессов и веб-разработки. Она предназначена для получения качественных результатов с меньшим количеством лишних правок и неопределенности, одновременно снижая использование токенов и количество вызовов модели, необходимых для выполнения задачи.

Максимальный контекст

1M

Максимальный вывод

65.5K

Дата выпуска

21 июл. 2026 г.

Вход$1.5 / млн токенов
Выход$7.5 / млн токенов
Чтение кэша$0.15 / млн токенов

xAI

Grok 4.5

grok-4.5

Grok 4.5 — это модель рассуждений от xAI, предназначенная для программирования, задач агентов и работы со знаниями. Она поддерживает ввод текста и изображений, контекст до 500 000 токенов, а также настраиваемую интенсивность рассуждений (низкая/средняя/высокая). Поддерживает вызов функций, поиск в Интернете и X, выполнение кода и структурированный вывод, что делает её подходящей для анализа длинного контекста, многошаговых вызовов инструментов и сквозных инженерных рабочих процессов. Её не следует рассматривать просто как чат-бота, связанного с платформой X.

Максимальный контекст

500K

Максимальный вывод

500K

Дата выпуска

8 июл. 2026 г.

Вход$2 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.3 / млн токенов

Alibaba

Qwen3.7 Plus

qwen3.7-plus

Qwen3.7 Plus в источниках выделяется следующими характеристиками: text+image input, vision-language upgrade, hybrid agent capability. Основная ценность модели связана с GUI-задачи, мобильная навигация, визуальные референсы рабочие процессы and экономичный Qwen3.7 use. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

1M

Максимальный вывод

64K

Дата выпуска

2 июн. 2026 г.

Вход$0.2857 / млн токенов
Выход$1.1429 / млн токенов
Чтение кэша$0.0571 / млн токенов

OpenAI

GPT-4.1

gpt-4.1

GPT-4.1 в источниках выделяется следующими характеристиками: improved программирование, instruction following and long контекст versus earlier GPT-4 generation. Основная ценность модели связана с инструменты разработчика, помощь в программировании and instruction-heavy tasks. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

1M

Максимальный вывод

32.8K

Дата выпуска

14 апр. 2025 г.

Вход$2 / млн токенов
Выход$8 / млн токенов
Чтение кэша$0.5 / млн токенов

OpenAI

GPT-4.1 Mini

gpt-4.1-mini

GPT-4.1 Mini в источниках выделяется следующими характеристиками: быстраяer/lower-cost GPT-4.1 variant. Основная ценность модели связана с высокий объем developer features, структурированный generation and извлечение. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

1M

Максимальный вывод

32.8K

Дата выпуска

14 апр. 2025 г.

Вход$0.4 / млн токенов
Выход$1.6 / млн токенов
Чтение кэша$0.1 / млн токенов

OpenAI

GPT-4o

gpt-4o

GPT-4o в источниках выделяется следующими характеристиками: мультимодальный GPT-4o flagship, text/image input and broad general intelligence. Основная ценность модели связана с vision-language applications, естественное взаимодействие and general assistant tasks. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

128K

Максимальный вывод

16.4K

Дата выпуска

13 мая 2024 г.

Вход$2.5 / млн токенов
Выход$10 / млн токенов
Чтение кэша$1.25 / млн токенов

OpenAI

GPT-4o Mini

gpt-4o-mini

GPT-4o Mini в источниках выделяется следующими характеристиками: small affordable GPT-4o model with text/image input and структурированный output support. Основная ценность модели связана с lightweight мультимодальный production, дообучение, дистилляция and focused tasks. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.

Максимальный контекст

128K

Максимальный вывод

16.4K

Дата выпуска

18 июл. 2024 г.

Вход$0.15 / млн токенов
Выход$0.6 / млн токенов
Чтение кэша$0.075 / млн токенов

Популярные модели

Начните с заметных моделей из live-каталога, а затем откройте страницу модели, чтобы сравнить контекст, эндпоинты и эффективную цену.

Alibaba

Qwen3.8 Max

Qwen3.8-Max — это флагманская модель MoE с 2,4 триллиона параметров, предназначенная для расширенного мышления, программирования и корпоративной производительности. Он может автономно выполнять сложные длительные задачи — от разработки программного обеспечения до профессиональных рабочих процессов, обеспечивая результаты производственного уровня в таких областях, как право, финансы и дизайн. Благодаря встроенному мультимодальному интеллекту Qwen3.8-Max понимает текст, изображения и видео в длинных контекстах, поддерживая глубокий анализ обширных документов и длинного контента. Его агентные возможности обеспечивают автономное планирование, выполнение, проверку и непрерывную итерацию на протяжении сложных рабочих процессов.

Максимальный контекст

1M

Цена входа

$2 / млн токенов

Открыть модель

Moonshot

Kimi K3

Kimi K3 — это высокопроизводительная модель ИИ, предназначенная для расширенных рассуждений, программирования и выполнения сложных задач. Она демонстрирует высокую эффективность в крупномасштабных проектах разработки, многошаговом решении проблем и приложениях с интенсивным использованием знаний. Благодаря широкой обработке контекста и мультимодальным возможностям, K3 подходит для создания мощных ИИ-агентов, инструментов разработчика и корпоративных приложений.

Максимальный контекст

1M

Цена входа

$2.8571 / млн токенов

Открыть модель

OpenAI

GPT-5.6 Sol

GPT-5.6 Sol — это стандартная версия серии Sol. Она подходит для общих вопросов и ответов, обработки текста, создания черновиков контента, реферирования, легкой помощи в написании кода и задач автоматизации бизнеса. Sol разработана для сценариев, где необходимы надежные общие способности при сохранении эффективности отклика и контроле затрат. Ее можно использовать для функций продуктов, чат-ассистентов, инструментов генерации контента, очистки данных, вопросно-ответных систем на базе знаний и пакетной обработки. Для крупномасштабного использования или быстрого прототипирования Sol является гибкой отправной точкой.

Максимальный контекст

1.1M

Цена входа

$5 / млн токенов

Открыть модель

OpenAI

GPT-5.6 Sol Pro

GPT-5.6 Sol Pro — это Pro-версия серии Sol, разработанная для сложных задач и более качественных результатов. Подходит для продвинутого письма, точных вопросов и ответов, бизнес-рассуждений, генерации кода, структурированного анализа и выполнения многошаговых задач. Sol Pro хорошо подходит для задач, требующих высокой точности, понимания контекста и выполнения инструкций. Может использоваться для создания профессионального контента, ассистентов анализа данных, систем ответов на вопросы на основе знаний, сложных рабочих процессов агентов и внутренних корпоративных ИИ-инструментов.

Максимальный контекст

1.1M

Цена входа

$5 / млн токенов

Открыть модель

OpenAI

GPT-5.6 Terra

GPT-5.6 Terra — это универсальная версия серии Terra. Она подходит для повседневных диалогов, генерации текста, суммаризации, извлечения информации, легковесных рассуждений и помощи в написании кода. Terra обеспечивает практичный баланс между общими возможностями, скоростью ответа и стоимостью. Её можно использовать для чат-ассистентов, инструментов контента, автоматизации офиса, вопросно-ответных систем по базам знаний и пакетной обработки текстов. Для быстрых итераций или чувствительных к затратам приложений Terra является надёжным вариантом по умолчанию в серии Terra.

Максимальный контекст

1.1M

Цена входа

$2.5 / млн токенов

Открыть модель

OpenAI

GPT-5.6 Terra Pro

GPT-5.6 Terra Pro — это улучшенная версия серии Terra, разработанная для получения высококачественных результатов при решении сложных задач. Подходит для продвинутых вопросов и ответов, создания глубокого контента, бизнес-анализа, помощи в программировании и многошаговых рассуждений. По сравнению со стандартной версией, Terra Pro лучше подходит для сценариев, требующих повышенной надежности, более полного рассуждения и точного следования инструкциям. Идеально для профессионального написания текстов, обобщения сложной информации, ассистентов на основе знаний, агентов автоматизации и корпоративных приложений ИИ.

Максимальный контекст

1.1M

Цена входа

$2.5 / млн токенов

Открыть модель

Сравнение моделей

Быстрое сравнение с выбранными соседними моделями каталога.

FAQ по каталогу моделей

Краткий гид по выбору, сравнению и использованию моделей из каталога TokenHub.

Как выбрать модель из списка?

+

Начните с вашей задачи. Используйте фильтры по провайдеру, тегам, типу эндпоинта и группе тарификации, затем сравните размер контекста, максимальный вывод, модальности и цены ввода или вывода.

Что означает эффективная цена?

+

Эффективная цена применяет коэффициент активной группы тарификации к данным цены модели. Это помогает оценить реальную стоимость ввода, вывода или запроса для выбранной группы.

Можно ли использовать эти модели через API?

+

Да. Откройте страницу модели, чтобы увидеть поддерживаемые типы эндпоинтов и ссылки на документацию. Доступность зависит от модели, провайдера и текущей конфигурации маршрутизации.

Почему важны окно контекста и максимальный вывод?

+

Окно контекста определяет, сколько промпта и истории диалога модель может прочитать. Максимальный вывод определяет объем одного ответа, что важно для длинных текстов, кода и документов.