Qwen3.5 35B-A3B

qwen3.5-35b-a3b

Qwen3.5 35B A3B reprend les éléments mis en avant par les sources : 35B A3B MoE, hybrid linear attention, sparse experts. Sa valeur principale se situe dans efficient raisonnement multimodal and programmation without dense-model cost. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.

Context Window

262.1K tokens

Maximum Output

65.5K tokens

Release Date

23 févr. 2026

Modalities

Prix de Qwen3.5 35B-A3B

Palier tokenPrix entréePrix sortie
<=128K$0.0571/M$0.4571/M
>128K$0.2286/M$1.8286/M

Fonctionnalités API de Qwen3.5 35B-A3B

Reasoning

Supported

Tool calling

Supported

Temperature parameter

Supported

Attachments

Supported

Knowledge Base

—

Endpoint Protocols

geminiCompletions APIMessages API

Points forts de Qwen3.5-35B-A3B

Qwen3.5-35B-A3B associe un MoE parcimonieux efficace, une compréhension multimodale native et un déploiement à poids ouverts pour des applications adaptables.

Efficacité du MoE parcimonieux

Le modèle compte 35 milliards de paramètres au total, dont 3 milliards activés, et combine l’attention Gated DeltaNet avec des experts parcimonieux pour une inférence efficace.

Multimodalité native

Une base vision-langage unifiée traite le texte, les images et les vidéos pour le raisonnement, la compréhension documentaire et les tâches visuelles.

Déploiement à poids ouverts

Les poids officiels sous licence Apache 2.0 permettent une inférence autogérée avec des frameworks tels que Transformers, vLLM et SGLang.

Cas d’usage de Qwen3.5-35B-A3B

Qwen3.5-35B-A3B convient aux assistants multimodaux auto-hébergés, au traitement visuel de documents et aux workflows de programmation adaptables.

Assistant multimodal privé

Déployer les poids ouverts dans une infrastructure contrôlée pour répondre à des questions sur des textes, images et vidéos internes.

Traitement visuel de documents

Lire le texte, les tableaux et les schémas de documents numérisés, extraire les champs utiles et produire des synthèses structurées.

Workflows de programmation

Générer et réviser du code, rechercher des défauts et intégrer le modèle à des outils de développement ou agents autogérés.

Comment utiliser Qwen3.5 35B-A3B via l’API TokenHub

Create API key

Replace these path values before running: {model}

curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
  -X 'POST' \
  -H "Authorization: Bearer $TOKENHUB_API_KEY"

Benchmark de Qwen3.5 35B-A3B

Score d’indice
Artificial Analysis Intelligence IndexSynthèse générale des capacités par Artificial Analysis23.4
Artificial Analysis Coding IndexSynthèse des tâches logicielles par Artificial Analysis16.8
Connaissances et raisonnement
GPQARésolution avancée de problèmes scientifiques81.9%
HLELarge ensemble d’examens de niveau expert12.8%
Programmation et ingénierie
SciCodeDéfis de programmation scientifique29.3%
Terminal-Bench HardExécution de tâches complexes dans un terminal10.6%
Respect des instructions et tâches d’agent
IFBenchRespect des contraintes du prompt44.5%
AA-LCRRaisonnement en contexte long55.3%
τ²-BenchTâches de workflow agentique86.3%

Mesures provenant de Artificial Analysis

Medias Et Discussions

Selection de videos et publications publiques liees a ce modele.

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

FAQ sur Qwen 3.5 35B A3B

Capacités, usages, limites et guide TokenHub pour Qwen 3.5 35B A3B.

Comment comprendre Qwen 3.5 35B A3B en équipe ?+

Qwen 3.5 35B A3B est un modèle proposé par Alibaba Qwen pour le raisonnement multimodal ouvert et les déploiements efficaces.

À quoi Qwen 3.5 35B A3B convient-il le mieux ?+

Idéal pour le déploiement auto-hébergé, le raisonnement visuel et l’assistance courante au code, surtout si l’objectif est le contrôle du déploiement.

Quel est l’atout principal de Qwen 3.5 35B A3B ?+

Atout clé : une variante MoE ouverte avec peu de paramètres actifs ainsi que une pensée hybride alternant entre réflexion et réponse directe.

Qwen 3.5 35B A3B est-il toujours le meilleur choix ?+

Il appartient à une génération antérieure et peut manquer de fonctions plus récentes. Pour les fonctions les plus récentes comptent, envisagez Qwen 3.6 35B A3B.

Quelle est la configuration la plus sûre ?+

Utilisez l’ID exact de TokenHub; le service hébergé peut différer de l’auto-hébergement.

Prêt à utiliser Qwen3.5 35B-A3B ?

Accédez à Qwen3.5 35B-A3B et à d’autres modèles d’IA avec une seule clé API TokenHub.

Créer une clé API