KoboldCpp é uma maneira fácil e de único executável para rodar modelos GGUF localmente com uma interface integrada, controles de amostragem robustos e suporte para texto, imagem e voz.
| Categoria | Executar LLMs localmente |
| Tipo | Execução local (arquivo único) |
| Licença | AGPL-3.0 |
| Executa localmente | Sim |
| Construído com | C++ |
| Nível de habilidade | Iniciante |
| Melhor para | inferência local em um arquivo com uma interface |
Outras ferramentas de código aberto para executar LLMs localmente que valem a pena comparar:
OllamaExecutar LLMs abertos localmente com um comando
JanAplicativo de desktop estilo ChatGPT, offline e de código aberto
GPT4AllIA local privada que roda em CPU
llama.cppO motor C/C++ que alimenta a inferência local
LocalAIUma API OpenAI que você hospeda
Text Generation WebUIInterface web rica em recursos para modelos locais
MLC LLMExecutar LLMs em qualquer dispositivo, até mesmo em telefones
llamafileUm arquivo executável = modelo + tempo de execução
exoExecute grandes modelos em seus dispositivos do dia a dia
CortexTempo de execução estilo Ollama da equipe Jan
Nexa SDKExecute qualquer modelo em qualquer dispositivo — CPU, GPU, NPU
RamaLamaExecute modelos como contêineres OCI
GPUStackGerencie clusters de GPU para executar modelosKoboldCpp é gratuito e de código aberto (licença AGPL-3.0), então você pode usar, auto-hospedar e modificar sem custo.
Sim. O KoboldCpp é projetado para rodar na sua própria máquina ou servidor, mantendo seus dados privados.
Alternativas populares de código aberto incluem Ollama, LM Studio, Jan. Veja as comparações acima para escolher.
Navegue pelo diretório completo de ferramentas, modelos e projetos de IA de código aberto — atualizado diariamente.
Navegue por todas as ferramentas →