Gemma 4 31B Instruct è il modello multimodale denso da 30.7B di Google DeepMind che supporta input testuali e visivi con output testuali.
I prezzi vengono aggiornati automaticamente — verificati quotidianamente rispetto ai listini prezzi dei fornitori.
Punteggi di benchmark indipendenti per Gemma 4 31B (gratuito), misurati da Artificial Analysis. Maggiore è meglio. Modalità di misurazione: Reasoning.
Gemma 4 31B (free) è un modello AI open-weight di Google. Può scaricarlo e self-hostarlo gratuitamente; i prezzi sotto sono i prezzi di listino delle API hosted, monitorati quotidianamente, per quando preferisce la comodità rispetto al self-hosting.
Gemma 4 31B (free) è un modello di linguaggio AI di Google. È open-weight: può scaricarlo ed eseguirlo sul proprio hardware, gratuitamente. Ottiene 29.7 sull'indice di intelligenza Artificial Analysis.
I pesi sono gratuiti e aperti — puoi ospitare Gemma 4 31B (gratuito) e non pagare nulla per token. Se preferisci un'API ospitata, i prezzi sono gratuiti per milione di token di input e gratuiti per milione di token di output.
I benchmark indipendenti di Artificial Analysis gli danno GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. È particolarmente utilizzato per generazione di codice.
Genera circa 35.6 token al secondo, con una mediana 0.92s di ritardo prima del primo token. Misurato indipendentemente da Artificial Analysis.
Sì. Gemma 4 31B (free) ha open weights, quindi può essere scaricato e eseguito sulla propria GPU o server con strumenti come Ollama, vLLM o llama.cpp — senza costi per token.