Gemma 4 31B Instruct es el modelo multimodal denso de 30.7B de Google DeepMind que admite entrada de texto e imagen con salida de texto.
Los precios se actualizan automáticamente; se verifican a diario contra las tarifas oficiales de los proveedores.
Puntuaciones de referencia independientes para Gemma 4 31B, medidas por Artificial Analysis. Más alto es mejor. Modo de medición: Reasoning.
Gemma 4 31B es un modelo de IA open-weight de Google. Puede descargarlo y alojarlo usted mismo (self-host) de forma gratuita; los precios a continuación son precios de lista de API alojada, rastreados a diario, para cuando prefiera la comodidad sobre el autoalojamiento.
Gemma 4 31B es un modelo de lenguaje de IA de Google. Es open-weight: puede descargarlo y ejecutarlo en su propio hardware, de forma gratuita. Obtiene 29.7 en el índice de inteligencia Artificial Analysis.
Los pesos son libres y abiertos: usted puede autoalojar Gemma 4 31B y no pagar nada por token. Si prefiere una API alojada, los precios de lista son $0.09 por millón de tokens de entrada y $0.34 por millón de tokens de salida.
Los benchmarks independientes de Artificial Analysis le dan GPQA 85.7%, Humanity's Last Exam 23.6%, Long Context Reasoning 68.3%, SciCode 43.4%, IFBench 75.6%, τ²-Bench 59.9%, τ-Bench Banking 14.8%, Terminal-Bench 43.4%, Terminal-Bench Hard 36.4%. Se utiliza particularmente para generación de código.
Genera aproximadamente 35.6 tokens por segundo, con una mediana 0.92s de retraso antes del primer token. Medido de forma independiente por Artificial Analysis.
Sí. Gemma 4 31B tiene open weights, por lo que puede descargarlo y ejecutarlo en su propia GPU o servidor con herramientas como Ollama, vLLM o llama.cpp — sin costo por token.