MLC LLM compile et exécute des LLM nativement sur des GPU, des navigateurs et des appareils mobiles en utilisant la compilation d'apprentissage automatique pour une inférence locale accélérée par matériel.
| Catégorie | Exécuter des LLM localement |
| Type | Déploiement universel de LLM |
| Licence | Apache-2.0 |
| S'exécute localement | Oui |
| Construit avec | Python / C++ |
| Niveau de compétence | Avancé |
| Meilleur pour | exécution de modèles sur des téléphones et le web |
Autres outils open-source pour exécuter des LLM localement qui valent la peine d'être comparés :
OllamaExécuter des LLM open-source localement avec une seule commande
JanApplication de bureau de style ChatGPT open-source et hors ligne
GPT4AllIA locale privée qui s'exécute sur CPU
llama.cppLe moteur C/C++ alimentant l'inférence locale
LocalAIUne API OpenAI à auto-héberger
Text Generation WebUIInterface web riche en fonctionnalités pour les modèles locaux
KoboldCppExécuteur de modèle local en un seul fichier
llamafileUn fichier exécutable = modèle + runtime
exoExécutez de grands modèles sur vos appareils quotidiens
CortexRuntime de style Ollama de l'équipe Jan
Nexa SDKExécutez n'importe quel modèle sur n'importe quel appareil — CPU, GPU, NPU
RamaLamaExécutez des modèles en tant que conteneurs OCI
GPUStackGérez des clusters GPU pour exécuter des modèlesMLC LLM est gratuit et open-source (licence Apache-2.0), vous pouvez donc l'utiliser, l'héberger vous-même et le modifier sans frais.
Oui. MLC LLM est conçu pour fonctionner sur votre propre machine ou serveur, gardant vos données privées.
Les alternatives open-source populaires incluent Ollama, LM Studio, Jan. Consultez les comparaisons ci-dessus pour choisir.
Parcourez le répertoire complet des outils, modèles et projets d'IA open-source — mis à jour quotidiennement.
Parcourez tous les outils →