Llama 4 Maverick (Meta): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par olud.ai.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Llama 4 Maverick, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Llama 4 Maverick est un modèle d'IA open-weight de Meta. Vous pouvez le télécharger et le déployer en self-hosted gratuitement ; les prix ci-dessous sont les prix de liste de l'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Llama 4 Maverick est un modèle de langage IA de Meta. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 14.5 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Llama 4 Maverick et ne rien payer par token. Si vous préférez une API hébergée, les prix de liste sont de 0,2 $ par million de tokens d'entrée et de 0,8 $ par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 67.1%, MMLU-Pro 80.9%, Humanity's Last Exam 4.9%, Long Context Reasoning 50%, LiveCodeBench 39.7%, SciCode 33.1%, MATH-500 88.9%, AIME 39%, AIME 2025 19.3%, IFBench 43%, τ²-Bench 17.8%, τ-Bench Banking 3.7%, Terminal-Bench 7.9%, Terminal-Bench Hard 6.8%. Il est particulièrement utilisé pour génération de code.
Il génère environ 101.8 tokens par seconde, avec un délai médian 0.58s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Llama 4 Maverick a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.