DeepSeek
DeepSeek V4.1 Flash
Contexte total
1M
Sortie max.
384K
Date de sortie
N/A
deepseek-v4-flash-vision-expDeepSeek V4 Flash Vision Exp est une variante expérimentale de DeepSeek V4 Flash 0731 dotée de capacités visuelles, introduisant la compréhension d'images tout en préservant les performances textuelles du modèle de base, notamment les capacités d'agent, le raisonnement et la connaissance du monde. Il repose sur une architecture de mélange d'experts (MoE) sparse avec 284B paramètres au total et 13B paramètres actifs.
Context Window
1M tokens
Maximum Output
384K tokens
Release Date
21 août 2026
Modalities
| Prix entrée | Prix sortie | Lecture cache |
|---|---|---|
| $0.2857/M | $1.1429/M | $0.0057/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
DeepSeek V4 Flash Vision Exp associe compréhension d’images, raisonnement, capacités agentiques et connaissances de DeepSeek V4 Flash pour des workflows multimodaux expérimentaux.
Le modèle accepte conjointement images et textes afin d’interpréter les éléments visuels dans le contexte d’une demande écrite.
Ses capacités textuelles suivent celles de DeepSeek V4 Flash pour le raisonnement, les connaissances générales et la résolution agentique de problèmes.
La compréhension visuelle peut être intégrée aux workflows agentiques afin que les décisions suivantes tiennent compte des informations présentes dans les images.
DeepSeek V4 Flash Vision Exp convient à l’interprétation de captures d’écran, à l’analyse de graphiques et de documents, ainsi qu’aux agents guidés par des entrées visuelles.
Examiner des captures d’application, décrire l’état visible de l’interface et repérer les éléments utiles au diagnostic ou à l’assistance.
Lire textes, tableaux et graphiques dans des images de documents, puis convertir les informations utiles en résultat textuel organisé.
Utiliser les informations détectées dans les images pour sélectionner les outils suivants, examiner un problème et produire une conclusion textuelle.
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.chat.completions.create({})
console.log(result.choices[0]?.message?.content)DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
| Score d’indice | ||
|---|---|---|
| Artificial Analysis Intelligence Index | Synthèse générale des capacités par Artificial Analysis | 51.8 |
| Artificial Analysis Coding Index | Synthèse des tâches logicielles par Artificial Analysis | 69.1 |
Mesures provenant de Artificial Analysis
Conseils pratiques pour évaluer et utiliser DeepSeek V4 Flash Vision Exp sur TokenHub.
Il s’agit d’un modèle multimodal expérimental de DeepSeek qui reçoit du texte et des images et produit du texte. DeepSeek le présente comme la variante visuelle de la famille V4 Flash.
Il convient à la description d’images, à la lecture de texte dans des captures d’écran, à l’analyse de graphiques et aux agents combinant indices visuels et raisonnement linguistique.
Son principal atout est d’associer les capacités textuelles de V4 Flash à une compréhension native des images. Il accepte des requêtes mêlant texte et image dans des API courantes et peut utiliser des outils dans des flux d’agents.
Le modèle est explicitement expérimental : vérifiez sa fiabilité avant un usage en production. Les images sont redimensionnées et converties en jetons, ce qui peut réduire la fidélité des détails ; les conclusions visuelles importantes doivent être contrôlées par une personne.
S’il est disponible dans votre compte TokenHub, utilisez l’identifiant exact deepseek-v4-flash-vision-exp avec le point d’accès et les identifiants TokenHub. Envoyez le texte et les images selon le format accepté par la route API TokenHub choisie.
DeepSeek propose ce modèle expérimental sur sa plateforme API et indique que les images, après redimensionnement, sont facturées au tarif de V4 Flash dans la limite de 384 jetons par image. La disponibilité et les tarifs TokenHub peuvent différer ; consultez la fiche actuelle avant le déploiement.
Choisissez-le lorsque l’image est indispensable et que vous souhaitez conserver, dans la même requête, les capacités textuelles et d’agent de type V4 Flash. Pour le texte seul, l’analyse visuelle très fine ou les charges critiques, comparez précision, latence, stabilité et coût sur des tests représentatifs.
Accédez à DeepSeek V4 Flash Vision Exp et à d’autres modèles d’IA avec une seule clé API TokenHub.
MéDias Et DéMonstrations De DeepSeek V4 Flash Vision Exp
Annonces publiques, conseils API, démonstrations et discussions communautaires vérifiés sur DeepSeek V4 Flash Vision Exp.
X (Twitter)
Reddit
YouTube