Ollama è un runtime locale leggero che scarica ed esegue modelli a peso aperto con un singolo comando ed espone un'API REST compatibile con OpenAI sulla tua macchina.
| Categoria | Esegui LLM localmente |
| Tipo | Runtime locale (CLI) |
| Licenza | MIT |
| Esegue localmente | Sì |
| Costruito con | Go |
| Livello di abilità | Principiante |
| Migliore per | sviluppatori che desiderano un'API per modelli locali scriptabile |
Altri strumenti open-source per eseguire LLM localmente da confrontare:
JanApp desktop in stile ChatGPT open-source e offline
GPT4AllAI locale privata che gira su CPU
llama.cppIl motore C/C++ che alimenta l'inferenza locale
LocalAIUn'API OpenAI che ospiti autonomamente
Text Generation WebUIInterfaccia web ricca di funzionalità per modelli locali
KoboldCppEseguitore di modelli locali in un singolo file
MLC LLMEsegui LLM su qualsiasi dispositivo, anche telefoni
llamafileUn file eseguibile = modello + runtime
exoEsegui modelli grandi sui tuoi dispositivi quotidiani
CortexRuntime in stile Ollama del team di Jan
Nexa SDKEsegui qualsiasi modello su qualsiasi dispositivo — CPU, GPU, NPU
RamaLamaEsegui modelli come contenitori OCI
GPUStackGestisci cluster GPU per eseguire modelliOllama è gratuito e open-source (licenza MIT), quindi puoi usarlo, ospitarlo autonomamente e modificarlo senza costi.
Sì. Ollama è progettato per funzionare sulla tua macchina o server, mantenendo i tuoi dati privati.
Le popolari alternative open-source includono LM Studio, Jan, GPT4All. Vedi i confronti sopra per scegliere.
Sfoglia l'intero elenco di strumenti, modelli e progetti AI open-source — aggiornato quotidianamente.
Sfoglia tutti gli strumenti →