Gemma 4 31B Instruct è il modello multimodale denso da 30.7B di Google DeepMind che supporta input testuali e visivi con output testuali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Gemma 4 31B, misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Gemma 4 31B è un modello AI open-weight di Google. È possibile scaricarlo e self-hostarlo gratuitamente; i prezzi di seguito sono i listini delle API ospitate, aggiornati giornalmente, per quando si preferisce la comodità rispetto al self-hosting.
Gemma 4 31B è un modello di linguaggio AI di Google. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 29.7 sull'indice di intelligenza Artificial Analysis.
I pesi sono liberi e aperti — può self-hostare Gemma 4 31B e non pagare nulla per token. Se preferisce un'API ospitata, i prezzi di listino sono $0.09 per milione di token di input e $0.34 per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 35.6 token al secondo, con una mediana 0.92s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Gemma 4 31B ha open weights, quindi può scaricarlo ed eseguirlo sul suo GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.