AllenAI

AOlmo 3 32B ThinkOPEN

Olmo 3 32B Think (AllenAI): preços da API ao vivo, janela de contexto e as melhores alternativas de código aberto, monitoradas diariamente pelo olud.ai.

Janela de contexto
66K
tokens
Preço de entrada
$0.15
por M tokens
Preço de saída
$0.5
por M tokens
Fornecedor
AllenAI

Os preços são atualizados automaticamente — verificados a cada hora em relação aos preços da lista do fornecedor.

Ver comparações de modelos → Compare todos os preços dos modelos

Benchmarks & performance

Pontuações de benchmark independentes para Olmo 3 32B Think, medidas pela Artificial Analysis. Quanto maior, melhor.

Intelligence index6.4
Math index73.7
GPQA61%
MMLU-Pro75.9%
Humanity's Last Exam5.9%
Long Context Reasoning0%
LiveCodeBench67.2%
SciCode28.6%
AIME 202573.7%
IFBench49.1%
τ²-Bench0%
Terminal-Bench Hard1.5%
Dados de benchmark por Artificial Analysis

Sobre este modelo

Olmo 3 32B Think é um modelo de IA de peso aberto da AllenAI. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são preços de lista da API hospedada, monitorados por hora, para quando você prefere conveniência em vez de auto-hospedagem.

Perguntas frequentes

O que é Olmo 3 32B Think?

Olmo 3 32B Think é um modelo de linguagem de IA da AllenAI. Ele é de peso aberto: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 6.4 no índice de inteligência Artificial Analysis.

O Olmo 3 32B Think é gratuito?

Os pesos são gratuitos e abertos — você pode auto-hospedar o Olmo 3 32B Think e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.15 por milhão de tokens de entrada e $0.5 por milhão de tokens de saída.

Para que serve o Olmo 3 32B Think?

Benchmarks independentes da Artificial Analysis dão a ele GPQA 61%, MMLU-Pro 75.9%, Humanity's Last Exam 5.9%, Long Context Reasoning 0%, LiveCodeBench 67.2%, SciCode 28.6%, AIME 2025 73.7%, IFBench 49.1%, τ²-Bench 0%, Terminal-Bench Hard 1.5%. É particularmente usado para raciocínio matemático.

Posso auto-hospedar o Olmo 3 32B Think?

Sim. O Olmo 3 32B Think tem pesos abertos, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.

Modelos relacionados