Alibaba
Qwen3.8 Omni Flash
Contexte total
1M
Sortie max.
131.1K
Date de sortie
N/A
qwen3.5-flashQwen3.5 flash reprend les éléments mis en avant par les sources : rapide native vision-language Qwen3.5 variant. Sa valeur principale se situe dans simples multimodal tasks, extraction, routage and appels fréquents. La description doit donc insister sur ces caractéristiques propres au modèle, plutôt que le présenter comme un chatbot générique.
Context Window
262.1K tokens
Maximum Output
65.5K tokens
Release Date
23 févr. 2026
Modalities
| Palier token | Prix entrée | Prix sortie | Création cache 5m | Lecture cache 5m |
|---|---|---|---|---|
| <=128K | $0.0286/M | $0.2857/M | $0.0357/M | $0.0029/M |
| 128K-256K | $0.1143/M | $1.1429/M | $0.1429/M | $0.0114/M |
| >256K | $0.1714/M | $1.7143/M | $0.2143/M | $0.0171/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Qwen3.5 Flash associe inférence rapide, compréhension multimodale native et traitement de longs contextes pour les charges de production exigeant une réponse rapide.
Son architecture hybride associant attention linéaire et MoE parcimonieux vise des réponses rapides tout en préservant les performances textuelles et multimodales générales.
Le modèle accepte du texte, des images et des vidéos en entrée et produit du texte, permettant de comprendre plusieurs médias avec un seul modèle.
Une fenêtre de contexte d’un million de tokens permet d’analyser de longs documents, des conversations étendues et de grands ensembles d’entrées mixtes.
Qwen3.5 Flash convient aux assistants multimodaux réactifs, au traitement rapide de contenu et à l’examen d’informations en contexte long.
Répondre aux questions des clients à partir de captures d’écran, d’images de produits ou de courtes vidéos, puis fournir des indications textuelles concises.
Classer, résumer ou extraire les faits essentiels de grands volumes de contenus textuels et visuels en vue d’un examen ultérieur.
Examiner de grands ensembles de documents ou de longs historiques de conversation, repérer les détails pertinents et produire une synthèse ciblée.
curl 'https://us-api.tokenhub.com/v1/messages' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Capacités, usages, limites et guide TokenHub pour Qwen 3.5 Flash.
Qwen 3.5 Flash est un modèle proposé par Alibaba Qwen pour la compréhension multimodale rapide et les volumes élevés.
Idéal pour les requêtes à grand volume, la compréhension d’images et de vidéos et la conversation générale, surtout si l’objectif est la vitesse et la maîtrise des coûts.
Atout clé : un fonctionnement multimodal rapide proche du niveau Plus ainsi que une pensée hybride alternant entre réflexion et réponse directe.
Il appartient à une génération antérieure et peut manquer de fonctions plus récentes. Pour les fonctions les plus récentes comptent, envisagez Qwen 3.6 Flash.
Utilisez l’ID exact affiché par TokenHub et vérifiez les fonctions dans la documentation du compte.
Accédez à Qwen3.5 Flash et à d’autres modèles d’IA avec une seule clé API TokenHub.
Medias Et Discussions
Selection de videos et publications publiques liees a ce modele.
X (Twitter)
Reddit
YouTube