Step 3.7 Flash est le dernier modèle Mixture-of-Experts multimodal à haute efficacité de StepFun.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Step 3.7 Flash, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Step 3.7 Flash est un modèle d'IA open-weight de Stepfun. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Step 3.7 Flash est un modèle de langage IA de Stepfun. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 30.9 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez héberger Step 3.7 Flash vous-même et ne rien payer par jeton. Si vous préférez une API hébergée, les prix de liste sont de 0,2 $ par million de jetons d'entrée et de 1,15 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 80.9%, Humanity's Last Exam 21.4%, Long Context Reasoning 69.7%, SciCode 40%, IFBench 67.3%, τ²-Bench 98.5%, τ-Bench Banking 12%, Terminal-Bench 39.3%, Terminal-Bench Hard 35.6%. Il est particulièrement utilisé pour génération de code.
Il génère environ 91.7 tokens par seconde, avec un délai médian 1.63s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. L'étape 3.7 Flash a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.