Alibaba
Qwen3.7 Plus
Максимальный контекст
1M
Максимальный вывод
64K
Дата выпуска
N/A
qwen3.8-maxQwen3.8-Max — это флагманская модель MoE с 2,4 триллиона параметров, предназначенная для расширенного мышления, программирования и корпоративной производительности. Он может автономно выполнять сложные длительные задачи — от разработки программного обеспечения до профессиональных рабочих процессов, обеспечивая результаты производственного уровня в таких областях, как право, финансы и дизайн. Благодаря встроенному мультимодальному интеллекту Qwen3.8-Max понимает текст, изображения и видео в длинных контекстах, поддерживая глубокий анализ обширных документов и длинного контента. Его агентные возможности обеспечивают автономное планирование, выполнение, проверку и непрерывную итерацию на протяжении сложных рабочих процессов.
Context Window
1M tokens
Maximum Output
128K tokens
Release Date
3 авг. 2026 г.
Modalities
| Цена входа | Цена выхода | Чтение кэша | Создание кэша 5m | Чтение кэша 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Qwen3.8 Max сочетает рассуждение, нативное понимание изображений, долгосрочное планирование и контекст на миллион токенов для сложных профессиональных задач.
Флагманская модель рассуждений предназначена для сложных задач программирования, офисной работы, права, финансов и дизайна.
Модель принимает текст, изображения и видео, позволяя интерпретировать визуальные документы, диаграммы и продолжительные видеоматериалы.
Контекст на миллион токенов и автономное планирование поддерживают длительные задачи с повторным анализом и итерациями.
Qwen3.8 Max подходит для программирования на уровне крупных проектов, анализа профессиональных документов и длительных мультимодальных процессов.
Анализировать крупные кодовые базы, согласовывать изменения между компонентами и итеративно выполнять сложные инженерные задачи.
Изучать объёмные юридические, финансовые или деловые материалы, извлекать значимые сведения и формировать структурированные выводы.
Интерпретировать диаграммы, изображения документов и длинные видео, извлекая события, связи и формируя краткие текстовые сводки.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)Ответы на частые вопросы об API Qwen3.8 Max, ценах, разработке и агентных сценариях, мультимодальных возможностях и сравнении моделей.
Qwen3.8 Max — флагманская MoE-модель Qwen для сложных рассуждений, программирования, корпоративной продуктивности и агентных сценариев. Она подходит для продакшен-задач, где требуется обрабатывать большой контекст и последовательно выполнять сложную длительную работу.
Qwen3.8 Max стоит оценить для сложного программирования, многошаговых рассуждений и агентных сценариев, требующих планирования, выполнения, проверки и итераций. Прежде чем выбрать его моделью по умолчанию в продакшене, протестируйте его на реальных задачах репозитория, вызовах инструментов и критериях качества.
Проверьте модальности и раздел API на этой странице, чтобы подтвердить типы входных данных и эндпоинты, доступные через TokenHub. Для сценариев с документами, изображениями или видео убедитесь в поддерживаемом формате запроса и протестируйте его на типичных исходных материалах перед запуском.
Создайте API-ключ TokenHub, скопируйте точный ID модели Qwen3.8 Max с этой страницы и выберите поддерживаемый эндпоинт в разделе API. Используйте сгенерированный пример запроса как основу для интеграции с OpenAI-совместимым или другим поддерживаемым клиентом.
Посмотрите текущие цены за входные, выходные и кэшированные токены на этой странице, затем оцените стоимость по обычному размеру промптов, длине ответов, числу запросов и доле попаданий в кэш. У длинного контекста, мультимодальных и агентных сценариев структура затрат может сильно отличаться от простого чата.
Используйте спецификации модели на этой странице как источник актуальных лимитов контекста и максимального вывода. Контекст определяет объем исходных материалов в запросе, а максимальный вывод — объем содержимого, который модель вернет за один ответ.
Универсального победителя нет. Сравнивайте Qwen3.8 Max и GLM-5.2 на той задаче, которую нужно выполнить: надежность кода и агентов, качество рассуждений, мультимодальные требования, лимиты контекста и вывода, текущие цены и совместимость эндпоинтов. Перед стандартизацией одного из моделей проведите небольшую оценку на репрезентативных промптах.
Получите доступ к Qwen3.8 Max и другим моделям ИИ с одним API-ключом TokenHub.
Материалы и демонстрации Qwen3.8-Max
Подборка публичных анонсов, демонстраций и обсуждений Qwen3.8-Max.
X (Twitter)
Reddit
YouTube