Meta

MLlama 3.1 8B InstructOPEN

Llama 3.1 8B Instruct (Meta): tarification API en direct, fenêtre de contexte et les meilleures alternatives open-source, suivies quotidiennement par OpenSourceAI.tech.

Fenêtre de contexte
131K
tokens
Prix d'entrée
$0.05
par M tokens
Prix de sortie
$0.08
par M tokens
Fournisseur
Meta

Les prix se mettent à jour automatiquement — vérifiés toutes les heures par rapport aux prix de la liste des fournisseurs.

Voir les comparaisons de modèles → Comparer tous les prix des modèles

Benchmarks & performance

Scores de référence indépendants pour Llama 3.1 8B Instruct, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.

16×
Plus d'intelligence par dollar que Claude Opus 5.
Pour le même budget, Llama 3.1 8B Instruct offre 16 fois plus de capacités. Les poids ouverts signifient également que vous pouvez l'héberger vous-même et ne rien payer par jeton.
Intelligence index7.6
Coding index5.4
Math index4.3
GPQA25.9%
MMLU-Pro47.6%
Humanity's Last Exam5.1%
Long Context Reasoning15.7%
LiveCodeBench11.6%
SciCode13.2%
MATH-50051.9%
AIME7.7%
AIME 20254.3%
IFBench28.6%
τ²-Bench16.4%
τ-Bench Banking1.6%
Terminal-Bench1.5%
Terminal-Bench Hard0.8%
⚡ Speed614.7 tokens/sec
⏱ Latency0.22s to first token
💰 Blended price$0.079 / 1M tokens
📈 Value96.2 intelligence points per $
Données de benchmark par Artificial Analysis

À propos de ce modèle

Llama 3.1 8B Instruct est un modèle d'IA à poids ouverts de Meta. Vous pouvez le télécharger et l'héberger vous-même gratuitement ; les prix ci-dessous sont des prix de liste d'API hébergées, suivis à l'heure, pour les moments où vous préférez la commodité à l'auto-hébergement.

Questions fréquemment posées

Qu'est-ce que Llama 3.1 8B Instruct ?

Llama 3.1 8B Instruct est un modèle de langage IA de Meta. Il est à poids ouverts : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 7.6 sur l'indice d'intelligence d'Artificial Analysis.

Llama 3.1 8B Instruct est-il gratuit ?

Les poids sont gratuits et ouverts — vous pouvez auto-héberger Llama 3.1 8B Instruct et ne rien payer par token. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de tokens d'entrée et de 0,08 $ par million de tokens de sortie.

À quoi est bon Llama 3.1 8B Instruct ?

Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 25.9%, MMLU-Pro 47.6%, Humanity's Last Exam 5.1%, Long Context Reasoning 15.7%, LiveCodeBench 11.6%, SciCode 13.2%, MATH-500 51.9%, AIME 7.7%, AIME 2025 4.3%, IFBench 28.6%, τ²-Bench 16.4%, τ-Bench Banking 1.6%, Terminal-Bench 1.5%, Terminal-Bench Hard 0.8%. Il est particulièrement utilisé pour génération de code.

Quelle est la vitesse de Llama 3.1 8B Instruct ?

Il génère environ 614.7 tokens par seconde, avec un délai médian 0.22s avant le premier token. Mesuré indépendamment par Artificial Analysis.

Puis-je auto-héberger Llama 3.1 8B Instruct ?

Oui. Llama 3.1 8B Instruct a des poids ouverts, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.

Alternatives open-source

Selon votre charge de travail, un modèle à poids ouverts que vous pouvez auto-héberger peut réduire considérablement les coûts ou supprimer complètement la tarification par token. Nos pages de comparaison mettent ce modèle côte à côte avec les meilleurs concurrents open-source.

Llama 4 MaverickMetaLlama 3.3 70B InstructMetaLlama 4 ScoutMetaLlama 3.1 70B InstructMetaLlama Guard 4 12BMetaLlama 3.2 3B InstructMeta