Gemma 4 31B Instruct é o modelo multimodal denso de 30.7B da Google DeepMind, suportando entrada de texto e imagem com saída de texto.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para o Gemma 4 31B (gratuito), medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: Reasoning.
Gemma 4 31B (free) é um modelo de IA open-weight da Google. Você pode baixá-lo e fazer self-host gratuitamente; os preços abaixo são preços de lista de hosted-API, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Gemma 4 31B (free) é um modelo de linguagem de IA da Google. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 29.7 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode auto-hospedar Gemma 4 31B (gratuito) e não pagar nada por token. Se preferir uma API hospedada, os preços listados são Gratuito por milhão de tokens de entrada e Gratuito por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. É particularmente usado para geração de código.
Ele gera cerca de 35.6 tokens por segundo, com uma mediana 0.92s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.
Sim. Gemma 4 31B (gratuito) tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.