Изучайте цены, возможности, конечные точки и покрытие поставщиков ИИ-моделей в одном производственном каталоге.
O
OpenAI
GPT-6.1 Sol
gpt-6.1-sol
ImagePDFText
Text
GPT-6.1 Sol — это продвинутая модель рассуждений, созданная для решения сложных задач, программирования и приложений на основе агентов. Она разработана, чтобы обеспечивать высокую производительность рассуждений, сохраняя практический баланс между интеллектом, скоростью и стоимостью.
В отличие от традиционных чат-моделей, ориентированных в основном на генерацию ответов, GPT-6.1 Sol оптимизирована для задач, требующих более глубокого мышления, включая многошаговые рассуждения, генерацию кода, отладку, анализ данных и следование сложным инструкциям.
GPT-6.1 Sol поддерживает надёжные рабочие процессы рассуждений, структурированные выходные данные и приложения на основе инструментов, что делает её подходящей для разработчиков, создающих ИИ-ассистентов, агентов для программирования, системы автоматизации и ИИ-приложения для продакшена.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
29 сент. 2026 г.
Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.1 / млн токенов
O
OpenAI
GPT-6.1 Sol Pro
gpt-6.1-sol-pro
ImagePDFText
Text
GPT-6.1 Sol Pro — это улучшенная версия GPT-6.1 Sol с расширенными возможностями рассуждения. Он использует ту же базовую модель, что и GPT-6.1 Sol, но включает reasoning.mode=pro, позволяя модели тратить значительно больше вычислений на каждый запрос.
Дополнительный бюджет рассуждений помогает GPT-6.1 Sol Pro справляться с более сложными задачами, требующими более глубокого анализа, более длительного планирования и более высокой точности. Он предназначен для задач, где получить наилучший возможный ответ важнее, чем скорость ответа или экономическая эффективность.
По сравнению с GPT-6.1 Sol, GPT-6.1 Sol Pro потребляет значительно больше токенов рассуждения на каждый запрос, что приводит к более высоким затратам на использование и более длительному времени ответа.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
29 сент. 2026 г.
Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.1 / млн токенов
A
Anthropic
Claude Sonnet 5.5
claude-sonnet-5.5
ImagePDFText
Text
Claude Sonnet 5.5 — это AI-модель нового поколения, созданная для продвинутого рассуждения, программирования, анализа и сложных агентных рабочих процессов. Она показывает высокие результаты в разработке ПО, понимании длинного контекста, мультимодальных задачах и профессиональной интеллектуальной работе, обеспечивая баланс интеллекта, скорости и эффективности. Благодаря усиленным способностям к рассуждению и улучшенному следованию инструкциям Claude Sonnet 5.5 отлично справляется с написанием и отладкой кода, анализом сложных документов, решением многошаговых задач и поддержкой AI-агентов, которым нужны надёжные решения и использование инструментов.
Максимальный контекст
1M
Максимальный вывод
128K
Дата выпуска
28 сент. 2026 г.
Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов
xAI
Grok 4.7
grok-4.7
ImagePDFText
Text
Grok 4.7 — новейшая модель xAI, созданная для сложных задач программирования, комплексных рассуждений и приложений, требующих работы с большими объёмами знаний. Она улучшает решение долгосрочных задач, самопроверку и выполнение рабочих процессов, что делает её подходящей для разработчиков интеллектуальных ассистентов и AI-продуктов.
Grok 4.7 показывает высокие результаты в программировании, аналитике и универсальных AI-задачах, сохраняя конкурентоспособную эффективность для промышленного развёртывания.
Максимальный контекст
500K
Максимальный вывод
500K
Дата выпуска
21 сент. 2026 г.
Вход$1.6 / млн токенов
Выход$4.8 / млн токенов
Чтение кэша$0.4 / млн токенов
A
Anthropic
Claude Opus 5.5
claude-opus-5.5
ImagePDFText
Text
Claude Opus 5.5 — флагманская интеллектуальная модель Anthropic, созданная для ресурсоёмких задач, требующих глубокого рассуждения, надёжности и длительного выполнения. Она демонстрирует высокую производительность в разработке ПО, агентных сценариях, профессиональной аналитике и задачах, требующих глубоких знаний.
Благодаря повышенной эффективности и усиленным механизмам защиты Claude Opus 5.5 оптимизирована для разработчиков, создающих сложные ИИ-приложения, которым требуется стабильная производительность при решении комплексных задач.
Максимальный контекст
1M
Максимальный вывод
128K
Дата выпуска
22 сент. 2026 г.
Вход$4 / млн токенов
Выход$20 / млн токенов
Чтение кэша$0.2 / млн токенов
O
OpenAI
GPT-6 Sol
gpt-6-sol
ImagePDFText
Text
GPT-6 Sol — высокопроизводительная модель серии GPT-6 от OpenAI, созданная для сложных задач рассуждения, разработки ПО и профессиональных рабочих процессов с ИИ. Она обеспечивает повышенный интеллект для многошагового решения задач, продвинутого программирования, анализа данных и агентных приложений.
GPT-6 Sol сочетает мощные способности к рассуждению с эффективным инференсом, что делает его подходящим для разработчиков, которым нужна передовая производительность для продакшн-систем ИИ.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
22 сент. 2026 г.
Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов
O
OpenAI
GPT-6 Sol Pro
gpt-6-sol-pro
ImagePDFText
Text
GPT-6 Sol Pro — это улучшенный вариант GPT-6 Sol с расширенными возможностями рассуждения, созданный для задач, требующих более глубокого анализа, повышенной точности и более надёжного многошагового выполнения.
Благодаря усиленным способностям к рассуждению GPT-6 Sol Pro обеспечивает более высокую производительность в разработке ПО, сложных рабочих процессах, анализе данных и приложениях ИИ-агентов. Он оптимизирован для разработчиков, создающих продвинутые ИИ-системы, которым нужны стабильные результаты на сложных задачах.
GPT-6 Sol Pro поддерживает обработку длинного контекста, вызов инструментов и структурированные выходные данные, что делает его подходящим для production-приложений, требующих мощного рассуждения и автоматизации.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
22 сент. 2026 г.
Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов
O
OpenAI
GPT-6 Luna
gpt-6-luna
ImagePDFText
Text
GPT-6 Luna — компактная и эффективная модель из семейства GPT-6 от OpenAI, созданная для обеспечения мощного языкового интеллекта при значительно улучшенной экономической эффективности. Она обеспечивает надежную работу в повседневных ИИ-приложениях, включая разговорный ИИ, генерацию контента, помощь в программировании и автоматизированные рабочие процессы. Благодаря большому контекстному окну и оптимизированной эффективности инференса GPT-6 Luna идеально подходит разработчикам, создающим масштабируемые ИИ-продукты с высокой пропускной способностью, низкой задержкой и предсказуемыми эксплуатационными затратами.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
22 сент. 2026 г.
Вход$0.1 / млн токенов
Выход$0.5 / млн токенов
Чтение кэша$0.01 / млн токенов
O
OpenAI
GPT-6 Luna Pro
gpt-6-luna-pro
ImagePDFText
Text
GPT-6 Luna Pro — это оптимизированная для рассуждений версия GPT-6 Luna, созданная для более эффективного решения задач при сохранении производительности и доступности семейства Luna.
Он повышает производительность на сложных инструкциях, задачах программирования, аналитических рабочих процессах и приложениях с лёгкими агентами по сравнению со стандартными моделями быстрого вывода. GPT-6 Luna Pro идеально подходит разработчикам, которым нужны ответы более высокого качества и при этом масштабируемость для производственных нагрузок.
Поддерживая длинный контекст, вызов функций и структурированные выходные данные, GPT-6 Luna Pro обеспечивает баланс между интеллектом, скоростью и экономичностью.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
22 сент. 2026 г.
Вход$0.1 / млн токенов
Выход$0.5 / млн токенов
Чтение кэша$0.01 / млн токенов
A
Alibaba
Qwen3.8 Omni Flash
qwen3.8-omni-flash
AudioImageTextVideo
Text
Qwen3.8 Omni Flash — омнимодальная модель нового поколения из семейства Qwen от Alibaba, созданная для понимания и обработки текста, изображений, аудио и видео в единой системе ИИ. Она сочетает сильный языковой интеллект с продвинутыми возможностями мультимодального понимания для реальных ИИ-приложений.
Поддерживая контекстное окно до 1 млн токенов, Qwen3.8 Omni Flash оптимизирована для анализа длинных документов, понимания мультимедиа и агентных рабочих процессов. Она может анализировать сложный аудио- и видеоконтент, выполнять рассуждения в нескольких модальностях и поддерживать вызов инструментов для создания интеллектуальных ИИ-приложений.
Разработанная для высокоэффективного развёртывания, Qwen3.8 Omni Flash обеспечивает отличный баланс между мультимодальным интеллектом, масштабируемостью и экономичностью, что делает её подходящей для разработчиков, создающих ИИ-ассистентов нового поколения, системы анализа контента и агентов автоматизации.
Максимальный контекст
1M
Максимальный вывод
131.1K
Дата выпуска
17 сент. 2026 г.
Вход$0.1143 / млн токенов
Выход$0.3857 / млн токенов
Чтение кэша$0.0143 / млн токенов
T
TypeSafe
Jev 1.13
jev-1.13
Text
Decisions
Jev 1.13 — первая модель принятия решений System One от TypeSafe AI, созданная для структурированного ИИ-суждения, а не генерации текста. Она анализирует предоставленный контекст и возвращает структурированные варианты, оценки и решения на основе уверенности. Jev предназначена для классификации, маршрутизации, оценки и автоматизации рабочих процессов; она обеспечивает быстрые и предсказуемые ИИ-решения с низкой задержкой и эффективным использованием токенов.
Максимальный контекст
32K
Максимальный вывод
N/A
Дата выпуска
18 сент. 2026 г.
Вход$0.042 / млн токенов
Выход$0 / млн токенов
Z
Z.ai
GLM-5.3-FlashX
glm-5.3-flashx
ImageTextVideo
Text
GLM-5.3-FlashX — высокоскоростная мультимодальная модель от Z.ai, созданная для быстрого и отзывчивого инференса с сохранением ключевых возможностей GLM-5.3-Flash. Поддерживает ввод текста, изображений, видео и файлов, а контекстное окно достигает 1 млн токенов.
Модель хорошо показывает себя в программировании, агентных рабочих процессах, визуальном понимании, задачах с длинным контекстом и сложных рассуждениях, что делает её отличным выбором для реальных ИИ-приложений, где важны и скорость, и интеллект.
Максимальный контекст
1M
Максимальный вывод
131.1K
Дата выпуска
18 сент. 2026 г.
Вход$0.2857 / млн токенов
Выход$1 / млн токенов
Чтение кэша$0.0814 / млн токенов
D
DeepSeek
DeepSeek V4.1 Flash
deepseek-v4.1-flash
ImageText
Text
DeepSeek-V4.1-Flash — это быстрая и эффективная мультимодальная ИИ-модель с продвинутыми возможностями рассуждения, программирования и работы в качестве агента. Поддерживая контекст до 1 млн токенов и нативное визуальное понимание, она обеспечивает интеллект передового уровня при более низких затратах на инференс, что делает её идеальной для ИИ-агентов, автоматизации, ассистентов по программированию и масштабируемых приложений.
Максимальный контекст
1M
Максимальный вывод
384K
Дата выпуска
10 сент. 2026 г.
Вход$0.2857 / млн токенов
Выход$1.1429 / млн токенов
Чтение кэша$0.0057 / млн токенов
O
OpenAI
GPT-6 Astra
gpt-6-astra
ImagePDFText
Text
GPT-6 Astra — флагманская модель OpenAI нового поколения, созданная для сложных рассуждений, разработки ПО, ИИ-агентов, исследований и ресурсоемких комплексных профессиональных рабочих процессов. Модель отлично справляется с многошаговыми задачами в коде, браузерах и профессиональном ПО, обеспечивая более высокую производительность в решении проблем, использовании инструментов и компьютера, а также в работе с длинным контекстом.
GPT-6 Astra поддерживает контекстное окно до 1,05 млн токенов и максимальный выход до 128 тыс. токенов. Несколько уровней усилий рассуждения — Low, Medium, High, XHigh и Max — позволяют разработчикам выбирать баланс между возможностями рассуждения, эффективностью и стоимостью в зависимости от сложности задачи.
Модель хорошо подходит для продвинутых ИИ-агентов, сложной разработки ПО, автоматизированных рабочих процессов, глубоких исследований, обработки длинных документов, анализа данных и корпоративных ИИ-приложений.
Максимальный контекст
1.1M
Максимальный вывод
128K
Дата выпуска
4 сент. 2026 г.
Вход$10 / млн токенов
Выход$50 / млн токенов
Чтение кэша$1 / млн токенов
A
Anthropic
Claude Fable 5.1
claude-fable-5.1
ImagePDFText
Text
Claude Fable 5 — модель Anthropic класса Mythos, предназначенная для сложных рассуждений, разработки программного обеспечения, работы со знаниями, визуального анализа и научных исследований. Созданная для долгосрочных агентных задач, она способна поддерживать планирование и выполнение в рамках сложных рабочих процессов, анализировать большие кодовые базы и документы, а также улучшать результаты на нескольких этапах. Claude Fable 5 отлично подходит для производственных приложений, требующих продвинутого программирования, исследований, профессионального анализа и надёжного автономного выполнения задач.
Максимальный контекст
1M
Максимальный вывод
128K
Дата выпуска
1 сент. 2026 г.
Вход$10 / млн токенов
Выход$50 / млн токенов
Чтение кэша$0.25 / млн токенов
Z
Z.ai
GLM-5.3-Flash
glm-5.3-flash
ImagePDFTextVideo
Text
GLM-5.3-Flash — первая нативно мультимодальная модель Z.ai в семействе GLM-5, созданная для быстрого программирования, визуального понимания и агентных рабочих процессов. Её архитектура MoE на 320B параметров активирует 18B параметров на токен и сочетает разреженное и линейное внимание, чтобы повысить эффективность задач с длинным контекстом. Используйте GLM API через TokenHub, чтобы оценить текущую цену GLM-5.3-Flash, ID модели, поддерживаемые входные данные, вызов инструментов, лимиты контекста и конечные точки перед развёртыванием для продакшн-кодинга или мультимодальных агентных задач.
Максимальный контекст
1M
Максимальный вывод
131.1K
Дата выпуска
26 авг. 2026 г.
Вход$0.1143 / млн токенов
Выход$0.4 / млн токенов
Чтение кэша$0.0329 / млн токенов
Z
Z.ai
GLM-5.3
glm-5.3
Text
Text
GLM-5.3 — новейшая флагманская модель Z.ai, созданная для продвинутого программирования, разработки ПО и долгосрочных агентных задач. Окно контекста на 1M токенов, до 128K выходных токенов, мощные рассуждения и возможность использования инструментов делают её идеальной для агентов-кодеров, сложных процессов разработки и многоэтапной автоматизации.
Максимальный контекст
1M
Максимальный вывод
128K
Дата выпуска
19 авг. 2026 г.
Вход$1.1429 / млн токенов
Выход$4 / млн токенов
Чтение кэша$0.2857 / млн токенов
T
Tencent
Hy4 preview
hy4-preview
Text
Text
Hy4 preview — флагманская модель Tencent Hunyuan нового поколения с открытым исходным кодом и архитектурой Mixture-of-Experts. Она создана для реальных задач продуктивности: программирования, офисной работы, научных исследований, рассуждений на длинном контексте и сложных агентных сценариев. Также известна как Tencent Hy4 preview или Hunyuan 4 preview. Модель имеет 770B параметров, активирует 49B параметров на токен и поддерживает окно контекста более 1M токенов. Она отлично справляется с пониманием больших кодовых баз и документов, многоэтапным планированием, использованием инструментов, отладкой, проверкой и длительным выполнением задач.
Максимальный контекст
1M
Максимальный вывод
64K
Дата выпуска
28 авг. 2026 г.
Вход$0.8571 / млн токенов
Выход$2.5714 / млн токенов
Чтение кэша$0.0429 / млн токенов
A
Alibaba
Qwen3.8 Max
qwen3.8-max
ImageTextVideo
Text
Qwen3.8-Max — это флагманская модель MoE с 2,4 триллиона параметров, предназначенная для расширенного мышления, программирования и корпоративной производительности. Он может автономно выполнять сложные длительные задачи — от разработки программного обеспечения до профессиональных рабочих процессов, обеспечивая результаты производственного уровня в таких областях, как право, финансы и дизайн. Благодаря встроенному мультимодальному интеллекту Qwen3.8-Max понимает текст, изображения и видео в длинных контекстах, поддерживая глубокий анализ обширных документов и длинного контента. Его агентные возможности обеспечивают автономное планирование, выполнение, проверку и непрерывную итерацию на протяжении сложных рабочих процессов.
Максимальный контекст
1M
Максимальный вывод
128K
Дата выпуска
3 авг. 2026 г.
Вход$2 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.25 / млн токенов
M
Moonshot
Kimi K3
kimi-k3
ImageText
Text
Kimi K3 — это высокопроизводительная модель ИИ, предназначенная для расширенных рассуждений, программирования и выполнения сложных задач. Она демонстрирует высокую эффективность в крупномасштабных проектах разработки, многошаговом решении проблем и приложениях с интенсивным использованием знаний. Благодаря широкой обработке контекста и мультимодальным возможностям, K3 подходит для создания мощных ИИ-агентов, инструментов разработчика и корпоративных приложений.
Максимальный контекст
1M
Максимальный вывод
131.1K
Дата выпуска
16 июл. 2026 г.
Вход$2.8571 / млн токенов
Выход$14.2857 / млн токенов
Чтение кэша$0.2857 / млн токенов
D
DeepSeek
DeepSeek V4 Flash Vision Exp
deepseek-v4-flash-vision-exp
ImageText
Text
DeepSeek V4 Flash Vision Exp — экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой зрения, добавляющая возможность понимания изображений и сохраняющая текстовые характеристики базовой модели, включая агентские способности, рассуждения и знания о мире. Она основана на разреженной архитектуре смеси экспертов (MoE) с общим количеством параметров 284B и 13B активных параметров.
Максимальный контекст
1M
Максимальный вывод
384K
Дата выпуска
21 авг. 2026 г.
Вход$0.2857 / млн токенов
Выход$1.1429 / млн токенов
Чтение кэша$0.0057 / млн токенов
Популярные модели
Начните с заметных моделей из live-каталога, а затем откройте страницу модели, чтобы сравнить контекст, эндпоинты и эффективную цену.
Краткий гид по выбору, сравнению и использованию моделей из каталога TokenHub.
Как выбрать модель из списка?
+
Начните с вашей задачи. Используйте фильтры по провайдеру, тегам, типу эндпоинта и группе тарификации, затем сравните размер контекста, максимальный вывод, модальности и цены ввода или вывода.
Что означает эффективная цена?
+
Эффективная цена применяет коэффициент активной группы тарификации к данным цены модели. Это помогает оценить реальную стоимость ввода, вывода или запроса для выбранной группы.
Можно ли использовать эти модели через API?
+
Да. Откройте страницу модели, чтобы увидеть поддерживаемые типы эндпоинтов и ссылки на документацию. Доступность зависит от модели, провайдера и текущей конфигурации маршрутизации.
Почему важны окно контекста и максимальный вывод?
+
Окно контекста определяет, сколько промпта и истории диалога модель может прочитать. Максимальный вывод определяет объем одного ответа, что важно для длинных текстов, кода и документов.