MLC LLM compila y ejecuta LLMs de forma nativa en GPUs, navegadores y dispositivos móviles utilizando compilación de aprendizaje automático para inferencia local acelerada por hardware.
| Categoría | Ejecutar LLMs localmente |
| Tipo | Despliegue universal de LLM |
| Licencia | Apache-2.0 |
| Ejecuta localmente | Sí |
| Construido con | Python / C++ |
| Nivel de habilidad | Avanzado |
| Mejor para | ejecutando modelos en teléfonos y la web |
Otras herramientas de código abierto para ejecutar LLMs localmente que vale la pena comparar:
OllamaEjecutar LLMs abiertos localmente con un solo comando
JanAplicación de escritorio estilo ChatGPT de código abierto y sin conexión
GPT4AllIA local privada que se ejecuta en CPU
llama.cppEl motor C/C++ que impulsa la inferencia local
LocalAIUna API de OpenAI que autohospedas
Text Generation WebUIInterfaz web rica en funciones para modelos locales
KoboldCppEjecutor de modelo local en un solo archivo
llamafileUn archivo ejecutable = modelo + tiempo de ejecución
exoEjecuta grandes modelos en tus dispositivos cotidianos
CortexTiempo de ejecución estilo Ollama del equipo de Jan
Nexa SDKEjecuta cualquier modelo en cualquier dispositivo — CPU, GPU, NPU
RamaLamaEjecuta modelos como contenedores OCI
GPUStackGestiona clústeres de GPU para ejecutar modelosMLC LLM es gratuito y de código abierto (licencia Apache-2.0), por lo que puedes usarlo, autoalojarlo y modificarlo sin costo alguno.
Sí. MLC LLM está diseñado para ejecutarse en tu propia máquina o servidor, manteniendo tus datos privados.
Las alternativas populares de código abierto incluyen Ollama, LM Studio, Jan. Consulta las comparaciones anteriores para elegir.
Navega por el directorio completo de herramientas, modelos y proyectos de IA de código abierto, actualizado diariamente.
Navega todas las herramientas →