Модели

Изучайте цены, возможности, конечные точки и покрытие поставщиков ИИ-моделей в одном производственном каталоге.

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol — это продвинутая модель рассуждений, созданная для решения сложных задач, программирования и приложений на основе агентов. Она разработана, чтобы обеспечивать высокую производительность рассуждений, сохраняя практический баланс между интеллектом, скоростью и стоимостью. В отличие от традиционных чат-моделей, ориентированных в основном на генерацию ответов, GPT-6.1 Sol оптимизирована для задач, требующих более глубокого мышления, включая многошаговые рассуждения, генерацию кода, отладку, анализ данных и следование сложным инструкциям. GPT-6.1 Sol поддерживает надёжные рабочие процессы рассуждений, структурированные выходные данные и приложения на основе инструментов, что делает её подходящей для разработчиков, создающих ИИ-ассистентов, агентов для программирования, системы автоматизации и ИИ-приложения для продакшена.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

29 сент. 2026 г.

Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.1 / млн токенов

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro — это улучшенная версия GPT-6.1 Sol с расширенными возможностями рассуждения. Он использует ту же базовую модель, что и GPT-6.1 Sol, но включает reasoning.mode=pro, позволяя модели тратить значительно больше вычислений на каждый запрос. Дополнительный бюджет рассуждений помогает GPT-6.1 Sol Pro справляться с более сложными задачами, требующими более глубокого анализа, более длительного планирования и более высокой точности. Он предназначен для задач, где получить наилучший возможный ответ важнее, чем скорость ответа или экономическая эффективность. По сравнению с GPT-6.1 Sol, GPT-6.1 Sol Pro потребляет значительно больше токенов рассуждения на каждый запрос, что приводит к более высоким затратам на использование и более длительному времени ответа.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

29 сент. 2026 г.

Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.1 / млн токенов

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5 — это AI-модель нового поколения, созданная для продвинутого рассуждения, программирования, анализа и сложных агентных рабочих процессов. Она показывает высокие результаты в разработке ПО, понимании длинного контекста, мультимодальных задачах и профессиональной интеллектуальной работе, обеспечивая баланс интеллекта, скорости и эффективности. Благодаря усиленным способностям к рассуждению и улучшенному следованию инструкциям Claude Sonnet 5.5 отлично справляется с написанием и отладкой кода, анализом сложных документов, решением многошаговых задач и поддержкой AI-агентов, которым нужны надёжные решения и использование инструментов.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

28 сент. 2026 г.

Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов

xAI

Grok 4.7

grok-4.7

Grok 4.7 — новейшая модель xAI, созданная для сложных задач программирования, комплексных рассуждений и приложений, требующих работы с большими объёмами знаний. Она улучшает решение долгосрочных задач, самопроверку и выполнение рабочих процессов, что делает её подходящей для разработчиков интеллектуальных ассистентов и AI-продуктов. Grok 4.7 показывает высокие результаты в программировании, аналитике и универсальных AI-задачах, сохраняя конкурентоспособную эффективность для промышленного развёртывания.

Максимальный контекст

500K

Максимальный вывод

500K

Дата выпуска

21 сент. 2026 г.

Вход$1.6 / млн токенов
Выход$4.8 / млн токенов
Чтение кэша$0.4 / млн токенов

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5 — флагманская интеллектуальная модель Anthropic, созданная для ресурсоёмких задач, требующих глубокого рассуждения, надёжности и длительного выполнения. Она демонстрирует высокую производительность в разработке ПО, агентных сценариях, профессиональной аналитике и задачах, требующих глубоких знаний. Благодаря повышенной эффективности и усиленным механизмам защиты Claude Opus 5.5 оптимизирована для разработчиков, создающих сложные ИИ-приложения, которым требуется стабильная производительность при решении комплексных задач.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

22 сент. 2026 г.

Вход$4 / млн токенов
Выход$20 / млн токенов
Чтение кэша$0.2 / млн токенов

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol — высокопроизводительная модель серии GPT-6 от OpenAI, созданная для сложных задач рассуждения, разработки ПО и профессиональных рабочих процессов с ИИ. Она обеспечивает повышенный интеллект для многошагового решения задач, продвинутого программирования, анализа данных и агентных приложений. GPT-6 Sol сочетает мощные способности к рассуждению с эффективным инференсом, что делает его подходящим для разработчиков, которым нужна передовая производительность для продакшн-систем ИИ.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

22 сент. 2026 г.

Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro — это улучшенный вариант GPT-6 Sol с расширенными возможностями рассуждения, созданный для задач, требующих более глубокого анализа, повышенной точности и более надёжного многошагового выполнения. Благодаря усиленным способностям к рассуждению GPT-6 Sol Pro обеспечивает более высокую производительность в разработке ПО, сложных рабочих процессах, анализе данных и приложениях ИИ-агентов. Он оптимизирован для разработчиков, создающих продвинутые ИИ-системы, которым нужны стабильные результаты на сложных задачах. GPT-6 Sol Pro поддерживает обработку длинного контекста, вызов инструментов и структурированные выходные данные, что делает его подходящим для production-приложений, требующих мощного рассуждения и автоматизации.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

22 сент. 2026 г.

Вход$2 / млн токенов
Выход$10 / млн токенов
Чтение кэша$0.2 / млн токенов

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna — компактная и эффективная модель из семейства GPT-6 от OpenAI, созданная для обеспечения мощного языкового интеллекта при значительно улучшенной экономической эффективности. Она обеспечивает надежную работу в повседневных ИИ-приложениях, включая разговорный ИИ, генерацию контента, помощь в программировании и автоматизированные рабочие процессы. Благодаря большому контекстному окну и оптимизированной эффективности инференса GPT-6 Luna идеально подходит разработчикам, создающим масштабируемые ИИ-продукты с высокой пропускной способностью, низкой задержкой и предсказуемыми эксплуатационными затратами.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

22 сент. 2026 г.

Вход$0.1 / млн токенов
Выход$0.5 / млн токенов
Чтение кэша$0.01 / млн токенов

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro — это оптимизированная для рассуждений версия GPT-6 Luna, созданная для более эффективного решения задач при сохранении производительности и доступности семейства Luna. Он повышает производительность на сложных инструкциях, задачах программирования, аналитических рабочих процессах и приложениях с лёгкими агентами по сравнению со стандартными моделями быстрого вывода. GPT-6 Luna Pro идеально подходит разработчикам, которым нужны ответы более высокого качества и при этом масштабируемость для производственных нагрузок. Поддерживая длинный контекст, вызов функций и структурированные выходные данные, GPT-6 Luna Pro обеспечивает баланс между интеллектом, скоростью и экономичностью.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

22 сент. 2026 г.

Вход$0.1 / млн токенов
Выход$0.5 / млн токенов
Чтение кэша$0.01 / млн токенов

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash — омнимодальная модель нового поколения из семейства Qwen от Alibaba, созданная для понимания и обработки текста, изображений, аудио и видео в единой системе ИИ. Она сочетает сильный языковой интеллект с продвинутыми возможностями мультимодального понимания для реальных ИИ-приложений. Поддерживая контекстное окно до 1 млн токенов, Qwen3.8 Omni Flash оптимизирована для анализа длинных документов, понимания мультимедиа и агентных рабочих процессов. Она может анализировать сложный аудио- и видеоконтент, выполнять рассуждения в нескольких модальностях и поддерживать вызов инструментов для создания интеллектуальных ИИ-приложений. Разработанная для высокоэффективного развёртывания, Qwen3.8 Omni Flash обеспечивает отличный баланс между мультимодальным интеллектом, масштабируемостью и экономичностью, что делает её подходящей для разработчиков, создающих ИИ-ассистентов нового поколения, системы анализа контента и агентов автоматизации.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

17 сент. 2026 г.

Вход$0.1143 / млн токенов
Выход$0.3857 / млн токенов
Чтение кэша$0.0143 / млн токенов

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13 — первая модель принятия решений System One от TypeSafe AI, созданная для структурированного ИИ-суждения, а не генерации текста. Она анализирует предоставленный контекст и возвращает структурированные варианты, оценки и решения на основе уверенности. Jev предназначена для классификации, маршрутизации, оценки и автоматизации рабочих процессов; она обеспечивает быстрые и предсказуемые ИИ-решения с низкой задержкой и эффективным использованием токенов.

Максимальный контекст

32K

Максимальный вывод

N/A

Дата выпуска

18 сент. 2026 г.

Вход$0.042 / млн токенов
Выход$0 / млн токенов

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX — высокоскоростная мультимодальная модель от Z.ai, созданная для быстрого и отзывчивого инференса с сохранением ключевых возможностей GLM-5.3-Flash. Поддерживает ввод текста, изображений, видео и файлов, а контекстное окно достигает 1 млн токенов. Модель хорошо показывает себя в программировании, агентных рабочих процессах, визуальном понимании, задачах с длинным контекстом и сложных рассуждениях, что делает её отличным выбором для реальных ИИ-приложений, где важны и скорость, и интеллект.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

18 сент. 2026 г.

Вход$0.2857 / млн токенов
Выход$1 / млн токенов
Чтение кэша$0.0814 / млн токенов

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash — это быстрая и эффективная мультимодальная ИИ-модель с продвинутыми возможностями рассуждения, программирования и работы в качестве агента. Поддерживая контекст до 1 млн токенов и нативное визуальное понимание, она обеспечивает интеллект передового уровня при более низких затратах на инференс, что делает её идеальной для ИИ-агентов, автоматизации, ассистентов по программированию и масштабируемых приложений.

Максимальный контекст

1M

Максимальный вывод

384K

Дата выпуска

10 сент. 2026 г.

Вход$0.2857 / млн токенов
Выход$1.1429 / млн токенов
Чтение кэша$0.0057 / млн токенов

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra — флагманская модель OpenAI нового поколения, созданная для сложных рассуждений, разработки ПО, ИИ-агентов, исследований и ресурсоемких комплексных профессиональных рабочих процессов. Модель отлично справляется с многошаговыми задачами в коде, браузерах и профессиональном ПО, обеспечивая более высокую производительность в решении проблем, использовании инструментов и компьютера, а также в работе с длинным контекстом. GPT-6 Astra поддерживает контекстное окно до 1,05 млн токенов и максимальный выход до 128 тыс. токенов. Несколько уровней усилий рассуждения — Low, Medium, High, XHigh и Max — позволяют разработчикам выбирать баланс между возможностями рассуждения, эффективностью и стоимостью в зависимости от сложности задачи. Модель хорошо подходит для продвинутых ИИ-агентов, сложной разработки ПО, автоматизированных рабочих процессов, глубоких исследований, обработки длинных документов, анализа данных и корпоративных ИИ-приложений.

Максимальный контекст

1.1M

Максимальный вывод

128K

Дата выпуска

4 сент. 2026 г.

Вход$10 / млн токенов
Выход$50 / млн токенов
Чтение кэша$1 / млн токенов

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5 — модель Anthropic класса Mythos, предназначенная для сложных рассуждений, разработки программного обеспечения, работы со знаниями, визуального анализа и научных исследований. Созданная для долгосрочных агентных задач, она способна поддерживать планирование и выполнение в рамках сложных рабочих процессов, анализировать большие кодовые базы и документы, а также улучшать результаты на нескольких этапах. Claude Fable 5 отлично подходит для производственных приложений, требующих продвинутого программирования, исследований, профессионального анализа и надёжного автономного выполнения задач.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

1 сент. 2026 г.

Вход$10 / млн токенов
Выход$50 / млн токенов
Чтение кэша$0.25 / млн токенов

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flash — первая нативно мультимодальная модель Z.ai в семействе GLM-5, созданная для быстрого программирования, визуального понимания и агентных рабочих процессов. Её архитектура MoE на 320B параметров активирует 18B параметров на токен и сочетает разреженное и линейное внимание, чтобы повысить эффективность задач с длинным контекстом. Используйте GLM API через TokenHub, чтобы оценить текущую цену GLM-5.3-Flash, ID модели, поддерживаемые входные данные, вызов инструментов, лимиты контекста и конечные точки перед развёртыванием для продакшн-кодинга или мультимодальных агентных задач.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

26 авг. 2026 г.

Вход$0.1143 / млн токенов
Выход$0.4 / млн токенов
Чтение кэша$0.0329 / млн токенов

Z.ai

GLM-5.3

glm-5.3

GLM-5.3 — новейшая флагманская модель Z.ai, созданная для продвинутого программирования, разработки ПО и долгосрочных агентных задач. Окно контекста на 1M токенов, до 128K выходных токенов, мощные рассуждения и возможность использования инструментов делают её идеальной для агентов-кодеров, сложных процессов разработки и многоэтапной автоматизации.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

19 авг. 2026 г.

Вход$1.1429 / млн токенов
Выход$4 / млн токенов
Чтение кэша$0.2857 / млн токенов

Tencent

Hy4 preview

hy4-preview

Hy4 preview — флагманская модель Tencent Hunyuan нового поколения с открытым исходным кодом и архитектурой Mixture-of-Experts. Она создана для реальных задач продуктивности: программирования, офисной работы, научных исследований, рассуждений на длинном контексте и сложных агентных сценариев. Также известна как Tencent Hy4 preview или Hunyuan 4 preview. Модель имеет 770B параметров, активирует 49B параметров на токен и поддерживает окно контекста более 1M токенов. Она отлично справляется с пониманием больших кодовых баз и документов, многоэтапным планированием, использованием инструментов, отладкой, проверкой и длительным выполнением задач.

Максимальный контекст

1M

Максимальный вывод

64K

Дата выпуска

28 авг. 2026 г.

Вход$0.8571 / млн токенов
Выход$2.5714 / млн токенов
Чтение кэша$0.0429 / млн токенов

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Max — это флагманская модель MoE с 2,4 триллиона параметров, предназначенная для расширенного мышления, программирования и корпоративной производительности. Он может автономно выполнять сложные длительные задачи — от разработки программного обеспечения до профессиональных рабочих процессов, обеспечивая результаты производственного уровня в таких областях, как право, финансы и дизайн. Благодаря встроенному мультимодальному интеллекту Qwen3.8-Max понимает текст, изображения и видео в длинных контекстах, поддерживая глубокий анализ обширных документов и длинного контента. Его агентные возможности обеспечивают автономное планирование, выполнение, проверку и непрерывную итерацию на протяжении сложных рабочих процессов.

Максимальный контекст

1M

Максимальный вывод

128K

Дата выпуска

3 авг. 2026 г.

Вход$2 / млн токенов
Выход$6 / млн токенов
Чтение кэша$0.25 / млн токенов

Moonshot

Kimi K3

kimi-k3

Kimi K3 — это высокопроизводительная модель ИИ, предназначенная для расширенных рассуждений, программирования и выполнения сложных задач. Она демонстрирует высокую эффективность в крупномасштабных проектах разработки, многошаговом решении проблем и приложениях с интенсивным использованием знаний. Благодаря широкой обработке контекста и мультимодальным возможностям, K3 подходит для создания мощных ИИ-агентов, инструментов разработчика и корпоративных приложений.

Максимальный контекст

1M

Максимальный вывод

131.1K

Дата выпуска

16 июл. 2026 г.

Вход$2.8571 / млн токенов
Выход$14.2857 / млн токенов
Чтение кэша$0.2857 / млн токенов

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp — экспериментальная версия DeepSeek V4 Flash 0731 с поддержкой зрения, добавляющая возможность понимания изображений и сохраняющая текстовые характеристики базовой модели, включая агентские способности, рассуждения и знания о мире. Она основана на разреженной архитектуре смеси экспертов (MoE) с общим количеством параметров 284B и 13B активных параметров.

Максимальный контекст

1M

Максимальный вывод

384K

Дата выпуска

21 авг. 2026 г.

Вход$0.2857 / млн токенов
Выход$1.1429 / млн токенов
Чтение кэша$0.0057 / млн токенов

Популярные модели

Начните с заметных моделей из live-каталога, а затем откройте страницу модели, чтобы сравнить контекст, эндпоинты и эффективную цену.

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol — это продвинутая модель рассуждений, созданная для решения сложных задач, программирования и приложений на основе агентов. Она разработана, чтобы обеспечивать высокую производительность рассуждений, сохраняя практический баланс между интеллектом, скоростью и стоимостью. В отличие от традиционных чат-моделей, ориентированных в основном на генерацию ответов, GPT-6.1 Sol оптимизирована для задач, требующих более глубокого мышления, включая многошаговые рассуждения, генерацию кода, отладку, анализ данных и следование сложным инструкциям. GPT-6.1 Sol поддерживает надёжные рабочие процессы рассуждений, структурированные выходные данные и приложения на основе инструментов, что делает её подходящей для разработчиков, создающих ИИ-ассистентов, агентов для программирования, системы автоматизации и ИИ-приложения для продакшена.

Максимальный контекст

1.1M

Цена входа

$2 / млн токенов

Открыть модель

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro — это улучшенная версия GPT-6.1 Sol с расширенными возможностями рассуждения. Он использует ту же базовую модель, что и GPT-6.1 Sol, но включает reasoning.mode=pro, позволяя модели тратить значительно больше вычислений на каждый запрос. Дополнительный бюджет рассуждений помогает GPT-6.1 Sol Pro справляться с более сложными задачами, требующими более глубокого анализа, более длительного планирования и более высокой точности. Он предназначен для задач, где получить наилучший возможный ответ важнее, чем скорость ответа или экономическая эффективность. По сравнению с GPT-6.1 Sol, GPT-6.1 Sol Pro потребляет значительно больше токенов рассуждения на каждый запрос, что приводит к более высоким затратам на использование и более длительному времени ответа.

Максимальный контекст

1.1M

Цена входа

$2 / млн токенов

Открыть модель

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 — это AI-модель нового поколения, созданная для продвинутого рассуждения, программирования, анализа и сложных агентных рабочих процессов. Она показывает высокие результаты в разработке ПО, понимании длинного контекста, мультимодальных задачах и профессиональной интеллектуальной работе, обеспечивая баланс интеллекта, скорости и эффективности. Благодаря усиленным способностям к рассуждению и улучшенному следованию инструкциям Claude Sonnet 5.5 отлично справляется с написанием и отладкой кода, анализом сложных документов, решением многошаговых задач и поддержкой AI-агентов, которым нужны надёжные решения и использование инструментов.

Максимальный контекст

1M

Цена входа

$2 / млн токенов

Открыть модель

xAI

Grok 4.7

Grok 4.7 — новейшая модель xAI, созданная для сложных задач программирования, комплексных рассуждений и приложений, требующих работы с большими объёмами знаний. Она улучшает решение долгосрочных задач, самопроверку и выполнение рабочих процессов, что делает её подходящей для разработчиков интеллектуальных ассистентов и AI-продуктов. Grok 4.7 показывает высокие результаты в программировании, аналитике и универсальных AI-задачах, сохраняя конкурентоспособную эффективность для промышленного развёртывания.

Максимальный контекст

500K

Цена входа

$1.6 / млн токенов

Открыть модель

Anthropic

Claude Opus 5.5

Claude Opus 5.5 — флагманская интеллектуальная модель Anthropic, созданная для ресурсоёмких задач, требующих глубокого рассуждения, надёжности и длительного выполнения. Она демонстрирует высокую производительность в разработке ПО, агентных сценариях, профессиональной аналитике и задачах, требующих глубоких знаний. Благодаря повышенной эффективности и усиленным механизмам защиты Claude Opus 5.5 оптимизирована для разработчиков, создающих сложные ИИ-приложения, которым требуется стабильная производительность при решении комплексных задач.

Максимальный контекст

1M

Цена входа

$4 / млн токенов

Открыть модель

OpenAI

GPT-6 Sol

GPT-6 Sol — высокопроизводительная модель серии GPT-6 от OpenAI, созданная для сложных задач рассуждения, разработки ПО и профессиональных рабочих процессов с ИИ. Она обеспечивает повышенный интеллект для многошагового решения задач, продвинутого программирования, анализа данных и агентных приложений. GPT-6 Sol сочетает мощные способности к рассуждению с эффективным инференсом, что делает его подходящим для разработчиков, которым нужна передовая производительность для продакшн-систем ИИ.

Максимальный контекст

1.1M

Цена входа

$2 / млн токенов

Открыть модель

Сравнение моделей

Быстрое сравнение с выбранными соседними моделями каталога.

FAQ по каталогу моделей

Краткий гид по выбору, сравнению и использованию моделей из каталога TokenHub.

Как выбрать модель из списка?

+

Начните с вашей задачи. Используйте фильтры по провайдеру, тегам, типу эндпоинта и группе тарификации, затем сравните размер контекста, максимальный вывод, модальности и цены ввода или вывода.

Что означает эффективная цена?

+

Эффективная цена применяет коэффициент активной группы тарификации к данным цены модели. Это помогает оценить реальную стоимость ввода, вывода или запроса для выбранной группы.

Можно ли использовать эти модели через API?

+

Да. Откройте страницу модели, чтобы увидеть поддерживаемые типы эндпоинтов и ссылки на документацию. Доступность зависит от модели, провайдера и текущей конфигурации маршрутизации.

Почему важны окно контекста и максимальный вывод?

+

Окно контекста определяет, сколько промпта и истории диалога модель может прочитать. Максимальный вывод определяет объем одного ответа, что важно для длинных текстов, кода и документов.