Ollama est un runtime local léger qui télécharge et exécute des modèles à poids ouverts avec une seule commande et expose une API REST compatible OpenAI sur votre machine.
| Catégorie | Exécuter des LLM localement |
| Type | Runtime local (CLI) |
| Licence | MIT |
| S'exécute localement | Oui |
| Construit avec | Go |
| Niveau de compétence | Débutant |
| Meilleur pour | les développeurs qui souhaitent une API de modèle local scriptable |
Autres outils open-source pour exécuter des LLM localement qui valent la peine d'être comparés :
JanApplication de bureau de style ChatGPT open-source et hors ligne
GPT4AllIA locale privée qui s'exécute sur CPU
llama.cppLe moteur C/C++ alimentant l'inférence locale
LocalAIUne API OpenAI à auto-héberger
Text Generation WebUIInterface web riche en fonctionnalités pour les modèles locaux
KoboldCppExécuteur de modèle local en un seul fichier
MLC LLMExécuter des LLM sur n'importe quel appareil, même les téléphones
llamafileUn fichier exécutable = modèle + runtime
exoExécutez de grands modèles sur vos appareils quotidiens
CortexRuntime de style Ollama de l'équipe Jan
Nexa SDKExécutez n'importe quel modèle sur n'importe quel appareil — CPU, GPU, NPU
RamaLamaExécutez des modèles en tant que conteneurs OCI
GPUStackGérez des clusters GPU pour exécuter des modèlesOllama est gratuit et open-source (licence MIT), vous pouvez l'utiliser, l'auto-héberger et le modifier sans frais.
Oui. Ollama est conçu pour s'exécuter sur votre propre machine ou serveur, gardant vos données privées.
Les alternatives open-source populaires incluent LM Studio, Jan, GPT4All. Consultez les comparaisons ci-dessus pour choisir.
Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.
Parcourez tous les outils →