/v1/chat/completionsStep 3.7 Flash
step-3.7-flashStep 3.7 Flash est un modèle multimodal à mélange d'experts (MoE) haute efficacité de StepFun, conçu pour les charges de travail d'agents et de développeurs à l'échelle de la production. Grâce à une compréhension native du texte et des images, une fenêtre de contexte de 256K et des capacités de raisonnement flexibles, il convient parfaitement au codage, à l'analyse visuelle et documentaire, à l'appel d'outils, aux tâches augmentées par recherche et aux flux de travail d'agents complexes en plusieurs étapes. Son architecture sparse de 198B n'active qu'environ 11B paramètres par token, équilibrant ainsi de solides performances de raisonnement et multimodales avec une inférence efficace.
Contexte total
256Ktokens
Sortie max.
256Ktokens
Date de sortie
29 mai 2026
Modalités
Prix de Step 3.7 Flash
| Prix entrée | Prix sortie | Lecture cache |
|---|---|---|
| $0.2/M | $1.15/M | $0.04/M |
Comment utiliser Step 3.7 Flash via l’API ?
/v1/responses/v1/messagesBenchmark de Step 3.7 Flash
Step 3.7 Flash
30.9
/100
Artificial Analysis Intelligence Index
Artificial Analysis broad capability aggregate
Score d’indice
39.6
/100
Artificial Analysis Coding Index
Artificial Analysis software task aggregate
Score d’indice
Mesures provenant de Artificial Analysis
FAQ sur step-3.7-flash
Questions fréquentes sur l’utilisation de step-3.7-flash avec TokenHub.
Qu’est-ce que step-3.7-flash ?+
step-3.7-flash est le modèle vision-langage à poids ouverts et mélange d’experts clairsemé de StepFun, conçu pour les agents, le code, la recherche, l’utilisation d’outils et la compréhension d’images.
À quels usages step-3.7-flash convient-il le mieux ?+
Il convient aux agents utilisant des outils, au code à l’échelle d’un dépôt, à l’analyse visuelle d’interfaces et de documents, aux recherches et aux tâches à haut débit mêlant perception et raisonnement.
Quels sont les principaux atouts de step-3.7-flash ?+
La vision native, le traitement de longs contextes, trois niveaux de raisonnement, l’accent mis sur la fiabilité des outils et les options de déploiement ouvertes le rendent souple pour les agents en production.
Quelles limites ou quels compromis faut-il considérer ?+
C’est un modèle très volumineux à auto-héberger ; un déploiement local peut donc demander beaucoup de mémoire et de calcul. Ses réponses peuvent être erronées : validez les résultats importants et comparez qualité, latence et coût sur votre charge réelle.
Comment utiliser step-3.7-flash avec l’API TokenHub ?+
Sélectionnez step-3.7-flash comme modèle dans votre requête API TokenHub, puis utilisez le point d’accès et les identifiants affichés dans votre compte. Suivez la documentation TokenHub à jour pour les contenus texte et image pris en charge.
Quels sont le tarif et la disponibilité de step-3.7-flash ?+
Les tarifs, régions et quotas TokenHub peuvent évoluer ; consultez donc la fiche du modèle et votre compte avant le déploiement. Le modèle propose aussi des poids ouverts et des hébergements en amont, mais sa disponibilité sur TokenHub dépend de TokenHub.
Quand choisir step-3.7-flash plutôt qu’un autre modèle ?+
Choisissez-le si vous avez besoin d’un agent multimodal rapide, capable d’utiliser des outils et offrant plusieurs modes de déploiement. Pour du texte simple, comparez un modèle plus petit ; pour une précision maximale, évaluez des modèles plus puissants sur vos données.
MéDias Et DéMonstrations De Step-3.7-flash
Sélection d’annonces, de tests et de discussions publiques sur step-3.7-flash.
X (Twitter)
Reddit
YouTube