Google

GGemini 3.5 Flash (batch)API

Gemini 3.5 Flash é o modelo multimodal de alta eficiência do Google, trazendo codificação e raciocínio de nível quase Pro a um custo e velocidade de nível Flash.

Janela de contexto
1M
tokens
Preço de entrada
$0.75
por M tokens
Preço de saída
$4.5
por M tokens
Fornecedor
Google

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Veja alternativas de código aberto → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para o Gemini 3.5 Flash (batch), medidas pela Artificial Analysis. Quanto maior, melhor. Modo de medição: high.

Intelligence index50.2
Coding index70.1
GPQA92.2%
Humanity's Last Exam41%
Long Context Reasoning69.3%
SciCode53.1%
IFBench76.3%
τ²-Bench95.3%
τ-Bench Banking25.4%
Terminal-Bench78.7%
Terminal-Bench Hard40.9%
⚡ Speed243 tokens/sec
⏱ Latency13.71s to first token
💰 Blended price$3.375 / 1M tokens
📈 Value14.9 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

O Gemini 3.5 Flash (batch) é um modelo de IA comercial do Google. As especificações abaixo são rastreadas automaticamente: os preços são atualizados a cada hora a partir de preços públicos, então os números nesta página refletem o custo atual de uso do modelo através de sua API.

Perguntas frequentes

O que é o Gemini 3.5 Flash (batch)?

Gemini 3.5 Flash (batch) é um modelo de linguagem de IA da Google. É um modelo proprietário, disponível através de uma API. Ele pontua 50.2 no índice de inteligência Artificial Analysis.

O Gemini 3.5 Flash (batch) é gratuito?

O Gemini 3.5 Flash (batch) não é gratuito: custa $0,75 por milhão de tokens de entrada e $4,5 por milhão de tokens de saída. Alternativas de peso aberto podem ser auto-hospedadas sem custo por token.

Para que serve o Gemini 3.5 Flash (batch)?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 92.2%, Humanity's Last Exam 41%, Long Context Reasoning 69.3%, SciCode 53.1%, IFBench 76.3%, τ²-Bench 95.3%, τ-Bench Banking 25.4%, Terminal-Bench 78.7%, Terminal-Bench Hard 40.9%. É particularmente usado para geração de código.

Quão rápido é o Gemini 3.5 Flash (batch)?

Ele gera cerca de 243 tokens por segundo, com uma mediana 13.71s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Modelos relacionados

Gemini 3.1 Pro PreviewGoogleGemini 3.1 Pro Preview Custom ToolsGoogleNano Banana Pro (Gemini 3 Pro Image)GoogleGoogle Gemini Pro LatestGoogleGemini 2.5 ProGoogleGemini 2.5 Pro Preview 05-06Google