Phi 4 vs Mercury 2 comparé — prix par token, fenêtre de contexte, multimodalité, ouverture et lequel choisir. Le modèle open-source peut-il remplacer le modèle payant ? Détails complets pour 2026.
Prix & spécifications actualisés à partir de données en direct · olud.ai
Prix des modèles ouverts = fournisseur le moins cher via OpenRouter; les tarifs des fabricants officiels peuvent être plus élevés.
| Spécification | Phi 4 | Mercury 2 | Gagnant |
|---|---|---|---|
| Fabricant | Microsoft | Inception | – |
| Type | Open-weight | Propriétaire | |
| Fenêtre de contexte | 16K tokens | 128K jetons | INMercury 2 |
| Prix d'entrée | $0.07/M · auto-hébergement gratuit | $0.25/M | |
| Prix de sortie | $0.14/M · auto-hébergement gratuit | $0.75/M | |
| Vision / multimodal | Non | Non | – |
| Appel d'outil / fonction | Non | Oui | INMercury 2 |
| Auto-hébergeable | Oui | Non (API uniquement) | |
| Licence | MIT | Propriétaire |
Phi 4 est ~5.4× moins cher que Mercury 2 sur les tokens de sortie ($0.14 vs $0.75 par M tokens).
| Capacité | Phi 4 | Mercury 2 |
|---|---|---|
| Open weights (téléchargeables) | ✓ | ✗ |
| Auto-hébergeable | ✓ | ✗ |
| Fonctionne entièrement hors ligne | ✓ | ✗ |
| Vision / multimodal | ✗ | ✗ |
| Appel d'outil / fonction | ✗ | ✓ |
| Fenêtre de contexte de 1M+ | ✗ | ✗ |
Scores de benchmark indépendants mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est (sauf pour la latence).
Données de benchmark par Artificial Analysis.
| Critère | Phi 4 | Mercury 2 |
|---|---|---|
| Efficacité des coûts | 5.0 | 5.0 |
| Fenêtre de contexte | 2.0 | 3.5 |
| Ouverture | 5.0 | 1.5 |
| Auto-hébergement | 5.0 | 1.0 |
| Multimodalité | 2.0 | 3.5 |
Les scores proviennent de données en direct — prix de sortie (coût), longueur de contexte, poids ouverts vs fermés (ouverture & auto-hébergement) et support de vision/outils (multimodalité). La qualité brute de la tâche n'est pas notée ici ; elle dépend de votre référence — voir le verdict.
[Microsoft Research](/microsoft) Phi-4 est conçu pour bien performer dans des tâches de raisonnement complexes et peut fonctionner efficacement dans des situations avec une mémoire limitée ou où des réponses rapides sont nécessaires. À 14 milliards...
Mercury 2 est un LLM de raisonnement extrêmement rapide, et le premier LLM de diffusion de raisonnement (dLLM). Au lieu de générer des tokens séquentiellement, Mercury 2 produit et affine plusieurs tokens en parallèle, atteignant...
Phi 4 est open-weight et compétitif sur de nombreuses tâches, mais Mercury 2 peut encore être meilleur sur les tâches de raisonnement les plus difficiles et le travail agentique. L'écart se réduit — évaluez les deux sur votre cas d'utilisation réel avant de décider.
Oui. Phi 4 a des open weights, vous pouvez donc l'auto-héberger sur vos propres GPU ou l'exécuter via une API à faible coût. Mercury 2 est uniquement API et ne peut pas être auto-hébergé.
Phi 4 coûte $0.14/M en sortie contre $0.75/M pour Mercury 2 — environ 5x moins cher via API, et gratuit si vous l'auto-hébergez.
Choisissez Phi 4 si vous souhaitez vous auto-héberger, garder vos données privées et éviter les frais par token — c'est open-weight et fonctionne sur votre propre matériel. Choisissez Mercury 2 si vous souhaitez une capacité de pointe via une API gérée sans infrastructure à exécuter.
Parcourez le classement complet des modèles open-source, des milliers d'outils et des benchmarks en direct — le tout au même endroit.
Ouvrir le classement →