Google

GGemini 3.5 Flash LiteAPI

Gemini 3.5 Flash Lite (Google): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo OpenSourceAI.tech.

Janela de contexto
1M
tokens
Preço de entrada
$0.3
por M tokens
Preço de saída
$2.5
por M tokens
Fornecedor
Google

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Veja alternativas de código aberto → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Gemini 3.5 Flash Lite, medidas pela Artificial Analysis. Quanto maior, melhor.

Intelligence index36.5
Coding index49.3
GPQA83.8%
Humanity's Last Exam17.5%
Long Context Reasoning62%
SciCode40.9%
τ-Bench Banking16.5%
Terminal-Bench53.6%
⚡ Speed365.6 tokens/sec
⏱ Latency7.29s to first token
💰 Blended price$0.85 / 1M tokens
📈 Value42.9 intelligence points per $
Dados de benchmark por Artificial Analysis

Sobre este modelo

Gemini 3.5 Flash Lite é um modelo de IA comercial do Google. As especificações abaixo são rastreadas automaticamente: os preços são atualizados a cada hora a partir de preços públicos, então os números nesta página refletem o custo atual de uso do modelo através de sua API.

Perguntas frequentes

O que é Gemini 3.5 Flash Lite?

Gemini 3.5 Flash Lite é um modelo de linguagem de IA da Google. É um modelo proprietário, disponível através de uma API. Ele pontua 36.5 no índice de inteligência Artificial Analysis.

Gemini 3.5 Flash Lite é gratuito?

Gemini 3.5 Flash Lite não é gratuito: custa $0.3 por milhão de tokens de entrada e $2.5 por milhão de tokens de saída. Alternativas com pesos abertos podem ser auto-hospedadas sem custo por token.

Para que serve Gemini 3.5 Flash Lite?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 83.8%, Humanity's Last Exam 17.5%, Long Context Reasoning 62%, SciCode 40.9%, τ-Bench Banking 16.5%, Terminal-Bench 53.6%. É particularmente usado para geração de código.

Qual é a velocidade do Gemini 3.5 Flash Lite?

Ele gera cerca de 365.6 tokens por segundo, com uma mediana 7.29s de atraso antes do primeiro token. Medido independentemente pela Artificial Analysis.

Alternativas de código aberto

Dependendo da sua carga de trabalho, um modelo de peso aberto que você pode auto-hospedar pode reduzir os custos drasticamente ou eliminar completamente a cobrança por token. Nossas páginas de comparação colocam este modelo lado a lado com os concorrentes de código aberto mais fortes.

Gemini 3.1 Pro PreviewGoogleGemini 2.5 ProGoogleGemini 3.5 FlashGoogleGemini 3.6 FlashGoogleGemini 3 Flash PreviewGoogleGemini 2.5 FlashGoogle