As melhores alternativas open-weight e self-hostable ao GPT-3.5 Turbo Instruct em 2026 — comparadas por preço, janela de contexto e capacidades. Execute-as localmente e reduza os custos da API.
Atualizado com dados ao vivo · olud.ai
GPT-3.5 Turbo Instruct é um modelo proprietário, apenas API. Esses modelos open-weight podem ser self-hosted, executados offline e usados a uma fração do custo — veja como os melhores se comparam.
Dentro de 0.5 pts do GPT-3.5 Turbo Instruct no índice de inteligência da Artificial Analysis · 10.0× mais barato por milhão de tokens de saída
Reka Flash 3 é um modelo de linguagem grande de propósito geral, ajustado para instruções, com 21 bilhões de parâmetros, desenvolvido pela Reka. Ele se destaca em chat geral, tarefas de codificação, seguimento de instruções e chamadas de função. Apresentando um...
Reka Flash 3 vs GPT-3.5 Turbo Instruct →Dentro de 1.3 pts do GPT-3.5 Turbo Instruct no índice de inteligência da Artificial Analysis · 14.3× mais barato por milhão de tokens de saída
[Microsoft Research](/microsoft) Phi-4 é projetado para ter um bom desempenho em tarefas de raciocínio complexo e pode operar de forma eficiente em situações com memória limitada ou onde respostas rápidas são necessárias. Com 14 bilhões...
Phi 4 vs GPT-3.5 Turbo Instruct →Dentro de 2.8 pts do GPT-3.5 Turbo Instruct no índice de inteligência da Artificial Analysis · 4.0× mais barato por milhão de tokens de saída
Olmo 3 32B Think é um modelo de grande escala, com 32 bilhões de parâmetros, projetado para raciocínio profundo, cadeias lógicas complexas e cenários avançados de seguimento de instruções. Sua capacidade permite um desempenho forte em tarefas de avaliação exigentes e...
Olmo 3 32B Think vs GPT-3.5 Turbo Instruct →Classificação ao vivo de modelos open-weight com preços, janelas de contexto e capacidades.
Abra a classificação →