Olmo 3 32B Think é um modelo de grande escala, com 32 bilhões de parâmetros, projetado especificamente para raciocínio profundo, cadeias de lógica complexas e cenários avançados de seguimento de instruções.
Os preços são atualizados automaticamente — verificados diariamente em relação aos preços de lista dos provedores.
Pontuações de benchmark independentes para Olmo 3 32B Think, medidas pela Artificial Analysis. Quanto maior, melhor.
Olmo 3 32B Think é um modelo de IA open-weight da AllenAI. Você pode baixá-lo e hospedá-lo gratuitamente; os preços abaixo são os preços de lista da API hospedada, rastreados diariamente, para quando você preferir conveniência em vez de self-hosting.
Olmo 3 32B Think é um modelo de linguagem de IA da AllenAI. É open-weight: você pode baixá-lo e executá-lo em seu próprio hardware, gratuitamente. Ele pontua 6.1 no índice de inteligência Artificial Analysis.
Os pesos são gratuitos e abertos — você pode auto-hospedar o Olmo 3 32B Think e não pagar nada por token. Se preferir uma API hospedada, os preços são $0.15 por milhão de tokens de entrada e $0.5 por milhão de tokens de saída.
Benchmarks independentes da Artificial Analysis dão a ele GPQA 61%, MMLU-Pro 75.9%, Humanity's Last Exam 6.4%, Long Context Reasoning 0%, LiveCodeBench 67.2%, SciCode 28.6%, AIME 2025 73.7%, IFBench 49.1%, τ²-Bench 0%, Terminal-Bench Hard 1.5%. É particularmente usado para raciocínio matemático.
Sim. Olmo 3 32B Think tem open weights, então você pode baixá-lo e executá-lo em sua própria GPU ou servidor com ferramentas como Ollama, vLLM ou llama.cpp — sem custo por token.