Google

GGemini 3.1 Flash Lite (batch)API

Gemini 3.1 Flash Lite é o modelo multimodal de alta eficiência da GA do Google, otimizado para cargas de trabalho de baixo tempo de latência e alto volume.

Janela de contexto
1M
tokens
Preço de entrada
$0.13
por M tokens
Preço de saída
$0.75
por M tokens
Fornecedor
Google

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Veja alternativas de código aberto → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Gemini 3.1 Flash Lite (batch), medidas pela Artificial Analysis. Quanto maior, melhor.

Intelligence index25
Coding index34.7
GPQA82.2%
Humanity's Last Exam16.2%
Long Context Reasoning65.3%
SciCode41.9%
IFBench77.2%
τ²-Bench31.3%
τ-Bench Banking8.7%
Terminal-Bench31.1%
Terminal-Bench Hard24.2%
⚡ Speed309.5 tokens/sec
⏱ Latency4.92s to first token
💰 Blended price$0.563 / 1M tokens
📈 Value44.4 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Gemini 3.1 Flash Lite (batch) é um modelo de IA comercial do Google. As especificações abaixo são rastreadas automaticamente: os preços são atualizados a cada hora a partir de preços públicos, então os números nesta página refletem o custo atual de uso do modelo através de sua API.

Perguntas frequentes

O que é o Gemini 3.1 Flash Lite (batch)?

Gemini 3.1 Flash Lite (batch) é um modelo de linguagem de IA da Google. É um modelo proprietário, disponível através de uma API. Ele pontua 25 no índice de inteligência Artificial Analysis.

O Gemini 3.1 Flash Lite (batch) é gratuito?

Gemini 3.1 Flash Lite (batch) não é gratuito: custa $0.13 por milhão de tokens de entrada e $0.75 por milhão de tokens de saída. Alternativas de peso aberto podem ser auto-hospedadas sem custo por token.

Para que o Gemini 3.1 Flash Lite (batch) é bom?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 82.2%, Humanity's Last Exam 16.2%, Long Context Reasoning 65.3%, SciCode 41.9%, IFBench 77.2%, τ²-Bench 31.3%, τ-Bench Banking 8.7%, Terminal-Bench 31.1%, Terminal-Bench Hard 24.2%. É particularmente usado para geração de código.

Quão rápido é o Gemini 3.1 Flash Lite (batch)?

Ele gera cerca de 309.5 tokens por segundo, com uma mediana 4.92s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Modelos relacionados

Gemini 3.1 Pro PreviewGoogleGemini 3.1 Pro Preview Custom ToolsGoogleNano Banana Pro (Gemini 3 Pro Image)GoogleGoogle Gemini Pro LatestGoogleGemini 2.5 ProGoogleGemini 2.5 Pro Preview 05-06Google