llama.cpp ist die leistungsstarke C/C++-Inference-Engine, die die meisten lokalen LLM-Tools unterstützt und GGUF-Modelle mit aggressiver Quantisierung über CPUs und GPUs unterstützt.
| Kategorie | LLMs lokal ausführen |
| Typ | Inference-Bibliothek (C/C++) |
| Lizenz | MIT |
| Läuft lokal | Ja |
| Hergestellt mit | C/C++ |
| Fähigkeitsstufe | Fortgeschritten |
| Am besten für | Entwickler, die maximale Kontrolle und Portabilität wünschen |
Andere Open-Source-Tools zum lokalen Ausführen von LLMs, die einen Vergleich wert sind:
OllamaFühren Sie offene LLMs lokal mit einem Befehl aus
JanOpen-Source, offline ChatGPT-ähnliche Desktop-App
GPT4AllPrivate lokale KI, die auf CPU läuft
LocalAIEine OpenAI-API, die Sie selbst hosten
Text Generation WebUIFunktionsreiche Web-UI für lokale Modelle
KoboldCppEinzeldatei-Läufer für lokale Modelle
MLC LLMLLMs auf jedem Gerät ausführen, sogar auf Handys
llamafileEine ausführbare Datei = Modell + Laufzeit
exoFühren Sie große Modelle auf Ihren Alltagsgeräten aus
CortexOllama-Stil Laufzeit vom Jan-Team
Nexa SDKFühren Sie jedes Modell auf jedem Gerät aus — CPU, GPU, NPU
RamaLamaFühren Sie Modelle als OCI-Container aus
GPUStackVerwalten Sie GPU-Cluster zum Ausführen von Modellenllama.cpp ist kostenlos und Open Source (MIT-Lizenz), sodass Sie es ohne Kosten nutzen, selbst hosten und modifizieren können.
Ja. llama.cpp ist so konzipiert, dass es auf Ihrem eigenen Computer oder Server läuft und Ihre Daten privat bleiben.
Beliebte Open-Source-Alternativen sind Ollama, LM Studio, Jan. Sehen Sie sich die Vergleiche oben an, um zu wählen.
Durchsuchen Sie das vollständige Verzeichnis von Open-Source-AI-Tools, Modellen und Projekten – täglich aktualisiert.
Alle Tools durchsuchen →