Gemma 4 31B Instruct est le modèle multimodal dense de 30.7B de Google DeepMind prenant en charge les entrées textuelles et d'image avec des sorties textuelles.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de benchmark indépendants pour Gemma 4 31B, mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Gemma 4 31B est un modèle d'IA open-weight de Google. Vous pouvez le télécharger et le self-host gratuitement ; les prix ci-dessous sont les tarifs d'API hébergée, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Gemma 4 31B est un modèle de langage IA de Google. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 29.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Gemma 4 31B et ne rien payer par jeton. Si vous préférez une API hébergée, les tarifs affichés sont de 0,09 $ par million de jetons d'entrée et 0,34 $ par million de jetons de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.
Il génère environ 35.6 tokens par seconde, avec un délai médian 0.92s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Gemma 4 31B a des open weights, donc vous pouvez le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par jeton.