Modèles AI · Open-Source vs Payant

Step 3.7 Flash Ouvert vs INMercury 2 Payant

Étape 3.7 Flash vs Mercury 2 comparé — prix par jeton, fenêtre de contexte, multimodalité, ouverture et lequel choisir. Le modèle open-source peut-il remplacer le modèle payant ? Détails complets pour 2026.

Prix & spécifications actualisés à partir de données en direct · olud.ai

Prix des modèles ouverts = fournisseur le moins cher via OpenRouter; les tarifs des fabricants officiels peuvent être plus élevés.

Step 3.7 FlashOuvertStepfun
$0.2 /M entrée
$1.15 /M sortiePas de frais par token si vous vous auto-hébergez
TypeOpen-weight
Fenêtre de contexte262K tokens
MultimodalOui
Auto-hébergéOui
INMercury 2PayantInception
$0.25 /M entrée
$0.75 /M sortieAPI gérée (pas d'infrastructure à gérer)
TypePropriétaire
Fenêtre de contexte128K jetons
MultimodalNon
Auto-hébergéNon
Choisir Step 3.7 Flash si vous souhaitez auto-héberger, garder vos données privées et éviter les frais par token — c'est open-weight et fonctionne sur votre propre matériel. Choisissez Mercury 2 si vous souhaitez une capacité de pointe via une API gérée sans infrastructure à exécuter.

Étape 3.7 Flash vs spécifications Mercury 2

SpécificationStep 3.7 FlashMercury 2Gagnant
FabricantStepfunInception
TypeOpen-weightPropriétaireStep 3.7 Flash
Fenêtre de contexte262K tokens128K jetonsStep 3.7 Flash
Prix d'entrée$0.2/M · auto-hébergement gratuit$0.25/MStep 3.7 Flash
Prix de sortie$1.15/M · auto-hébergement gratuit$0.75/MINMercury 2
Vision / multimodalOuiNonStep 3.7 Flash
Appel d'outil / fonctionOuiOui= Égalité
Auto-hébergeableOuiNon (API uniquement)Step 3.7 Flash
LicenceOpen weightsPropriétaireStep 3.7 Flash

Écart de prix & quand choisir chacun

1.5×moins cher par jeton de sortie

Mercury 2 est ~1.5× moins cher que Étape 3.7 Flash sur les jetons de sortie ($0.75 vs $1.15 par M jetons).

Choisissez l'Étape 3.7 Flash si…
  • Vous souhaitez vous auto-héberger ou exécuter sur votre cloud
  • Vous avez besoin de la fenêtre de contexte plus longue de 262K
  • Vous privilégiez la confidentialité des données & le contrôle
  • Vous construisez une IA ouverte ou reproductible
INChoisissez Mercury 2 si…
  • Vous souhaitez des performances de pointe via une API gérée
  • Vous voulez un prix de sortie plus bas
  • Vous valorisez la fiabilité & l'écosystème
  • Vous ne souhaitez pas gérer l'infrastructure

Comparaison des fonctionnalités

CapacitéStep 3.7 FlashMercury 2
Open weights (téléchargeables)
Auto-hébergeable
Fonctionne entièrement hors ligne
Vision / multimodal
Appel d'outil / fonction
Fenêtre de contexte de 1M+

Benchmarks : Step 3.7 Flash vs Mercury 2

Scores de benchmark indépendants mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est (sauf pour la latence).

Step 3.7 Flash
Mercury 2
Indice d'intelligence
30.3
21.4
Indice de codage
39.6
31.1
GPQA
80.9%
77%
Le Dernier Examen de l'Humanité
19.9%
15.5%
Raisonnement sur de longs contextes
63.7%
36.3%
SciCode
40%
38.7%
IFBench
67.3%
69.8%
τ²-Bench
98.5%
70.8%
τ-Bench Banking
11.3%
9.9%
Terminal-Bench
39.3%
27.3%
Terminal-Bench Hard
35.6%
26.5%
Vitesse
383.1 tok/s
1082 tok/s
Latence
0.9s
3,86s
Intelligence par $
69.2
57.1

Données de benchmark par Artificial Analysis.

Comment Step 3.7 Flash et Mercury 2 se classent

🏆 Meilleur rapport qualité-prix & ouverture : Step 3.7 Flash (4.7 vs 2.9 / 5)
CritèreStep 3.7 FlashMercury 2
Efficacité des coûts4.55.0
Fenêtre de contexte4.03.5
Ouverture5.01.5
Auto-hébergement5.01.0
Multimodalité5.03.5

Les scores proviennent de données en direct — prix de sortie (coût), longueur de contexte, poids ouverts vs fermés (ouverture & auto-hébergement) et support de vision/outils (multimodalité). La qualité brute de la tâche n'est pas notée ici ; elle dépend de votre référence — voir le verdict.

Ce que chaque modèle est

Step 3.7 Flash Ouvert

Stepfun · Open-weight

Step 3.7 Flash est le dernier modèle multimodal Mixture-of-Experts à haute efficacité de StepFun. Il associe un backbone linguistique de 196B paramètres avec un encodeur de vision pour une compréhension native des images et des vidéos, activant environ 11B de paramètres...

Mercury 2 Payant

Inception · Propriétaire

Mercury 2 est un LLM de raisonnement extrêmement rapide, et le premier LLM de diffusion de raisonnement (dLLM). Au lieu de générer des tokens séquentiellement, Mercury 2 produit et affine plusieurs tokens en parallèle, atteignant...

Autres modèles dans ces familles

Ces variantes sont suivies mais pas comparées ici — une page par famille maintient la comparaison lisible.

Autres variantes suivies
Étape 3.5 Flash

Questions fréquemment posées

Step 3.7 Flash est-il aussi bon que Mercury 2 ?

Step 3.7 Flash est open-weight et compétitif sur de nombreuses tâches, mais Mercury 2 peut encore mener sur les travaux de raisonnement les plus difficiles et les travaux agentiques. L'écart se réduit — évaluez les deux sur votre cas d'utilisation réel avant de décider.

Puis-je exécuter l'Étape 3.7 Flash localement ?

Oui. Step 3.7 Flash a des open weights, donc vous pouvez l'auto-héberger sur vos propres GPU ou l'exécuter via une API à faible coût. Mercury 2 est uniquement API et ne peut pas être auto-hébergé.

Step 3.7 Flash vs Mercury 2 — lequel devrais-je choisir en 2026 ?

Choisissez Step 3.7 Flash si vous souhaitez vous auto-héberger, garder vos données privées et éviter les frais par jeton — c'est open-weight et fonctionne sur votre propre matériel. Choisissez Mercury 2 si vous souhaitez une capacité de pointe via une API gérée sans infrastructure à exécuter.

Les gens comparent aussi

Explorez plus d'IA open-source

Parcourez le classement complet des modèles open-source, des milliers d'outils et des benchmarks en direct — le tout au même endroit.

Ouvrir le classement →