Alibaba
Qwen3.8 Omni Flash
Максимальный контекст
1M
Максимальный вывод
131.1K
Дата выпуска
N/A
qwen3.5-35b-a3bQwen3.5 35B A3B в источниках выделяется следующими характеристиками: 35B A3B MoE, hybrid linear attention, sparse experts. Основная ценность модели связана с efficient мультимодальный рассуждение and программирование without dense-model cost. Поэтому в описании стоит подчеркнуть именно эти отличия, а не подавать модель как обычный универсальный чат-бот.
Context Window
262.1K tokens
Maximum Output
65.5K tokens
Release Date
23 февр. 2026 г.
Modalities
| Уровень токенов | Цена входа | Цена выхода |
|---|---|---|
| <=128K | $0.0571/M | $0.4571/M |
| >128K | $0.2286/M | $1.8286/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Qwen3.5-35B-A3B сочетает эффективную разреженную MoE, нативное мультимодальное понимание и развёртывание открытых весов для гибко настраиваемых приложений.
Модель содержит 35 млрд параметров, активируя 3 млрд, и сочетает внимание Gated DeltaNet с разреженными экспертами для эффективного вывода.
Единая визуально-языковая основа обрабатывает текст, изображения и видео для рассуждений, понимания документов и визуальных задач.
Официальные веса под лицензией Apache 2.0 позволяют самостоятельно развёртывать вывод с помощью Transformers, vLLM и SGLang.
Qwen3.5-35B-A3B подходит для самостоятельно размещаемых мультимодальных помощников, визуальной обработки документов и настраиваемых процессов программирования.
Развернуть открытые веса в контролируемой инфраструктуре для ответов на вопросы по внутренним текстам, изображениям и видео.
Распознавать текст, таблицы и схемы на изображениях документов, извлекать нужные поля и формировать структурированные сводки.
Генерировать и изменять код, исследовать дефекты и интегрировать модель в самостоятельно управляемые инструменты разработчика или агенты.
Replace these path values before running: {model}
curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"| Индексный балл | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Сводная оценка общих возможностей | 23.4 |
| Artificial Analysis Coding Index | Сводная оценка навыков программирования | 16.8 |
| Знания и рассуждения | ||
| GPQA | Решение сложных научных задач | 81.9% |
| HLE | Экспертные задания по широкому кругу тем | 12.8% |
| Программирование и разработка ПО | ||
| SciCode | Задачи по научному программированию | 29.3% |
| Terminal-Bench Hard | Сложные задачи в терминале | 10.6% |
| Следование инструкциям и агентные задачи | ||
| IFBench | Соблюдение условий промпта | 44.5% |
| AA-LCR | Рассуждения в длинном контексте | 55.3% |
| τ²-Bench | Агентные рабочие процессы | 86.3% |
Источник метрик Artificial Analysis
Возможности, сценарии, ограничения и работа с Qwen 3.5 35B A3B в TokenHub.
Qwen 3.5 35B A3B — модель Alibaba Qwen для открытого мультимодального рассуждения и эффективного развертывания.
Лучше всего для самостоятельного развертывания, визуального рассуждения и повседневной помощи в программировании, особенно если приоритет — контроль развертывания.
Ключевое преимущество: открытый вариант MoE с небольшой долей активных параметров и гибридное мышление с переключением между рассуждением и прямым ответом.
Это более старое поколение, поэтому новых возможностей может не быть. Если важны важны новейшие возможности, рассмотрите Qwen 3.6 35B A3B.
Используйте точный ID TokenHub; поведение хостинга может отличаться от самостоятельного развертывания.
Получите доступ к Qwen3.5 35B-A3B и другим моделям ИИ с одним API-ключом TokenHub.
Материалы и обсуждения
Подборка публичных видео и публикаций, связанных с этой моделью.
X (Twitter)
Reddit
YouTube