Granite 4.1 8B est un modèle de langage dense, uniquement décodeur, de 8 milliards de paramètres d'IBM, faisant partie de la famille Granite 4.1.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Granite 4.1 8B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est.
Granite 4.1 8B est un modèle d'IA open-weight d'IBM. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Granite 4.1 8B est un modèle de langage IA de IBM. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 6.4 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez héberger Granite 4.1 8B vous-même et ne rien payer par jeton. Si vous préférez une API hébergée, les prix sont de 0,05 $ par million de jetons d'entrée et de 0,1 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 43.3%, Humanity's Last Exam 3.8%, Long Context Reasoning 11.3%, SciCode 21.8%, IFBench 38.6%, τ²-Bench 27.8%, Terminal-Bench 3.4%, Terminal-Bench Hard 0%. Il est particulièrement utilisé pour génération de code.
Il génère environ 126.2 tokens par seconde, avec un délai médian 0.45s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Granite 4.1 8B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.