Gemma 4 31B Instruct est le modèle multimodal dense de 30.7B de Google DeepMind prenant en charge les entrées textuelles et d'image avec des sorties textuelles.
Les prix se mettent à jour automatiquement — vérifiés quotidiennement par rapport aux prix catalogue des fournisseurs.
Scores de référence indépendants pour Gemma 4 31B (gratuit), mesurés par Artificial Analysis. Plus c'est élevé, mieux c'est. Mode de mesure : Reasoning.
Gemma 4 31B (free) est un modèle d'IA open-weight de Google. Vous pouvez le télécharger et le self-hoster gratuitement ; les prix ci-dessous sont les prix catalogue des API hébergées, suivis quotidiennement, pour quand vous préférez la commodité au self-hosting.
Gemma 4 31B (free) est un modèle de langage IA de Google. Il est open-weight : vous pouvez le télécharger et l'exécuter sur votre propre matériel, gratuitement. Il obtient un score de 29.7 sur l'indice d'intelligence d'Artificial Analysis.
Les poids sont gratuits et ouverts — vous pouvez auto-héberger Gemma 4 31B (gratuit) et ne rien payer par token. Si vous préférez une API hébergée, les prix sont gratuits par million de tokens d'entrée et gratuits par million de tokens de sortie.
Des benchmarks indépendants d'Artificial Analysis lui donnent GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. Il est particulièrement utilisé pour génération de code.
Il génère environ 35.6 tokens par seconde, avec un délai médian 0.92s avant le premier token. Mesuré indépendamment par Artificial Analysis.
Oui. Gemma 4 31B (gratuit) a des open weights, vous pouvez donc le télécharger et l'exécuter sur votre propre GPU ou serveur avec des outils comme Ollama, vLLM ou llama.cpp — sans coût par token.