Ollama es un entorno de ejecución local ligero que descarga y ejecuta modelos de peso abierto con un solo comando y expone una API REST compatible con OpenAI en tu máquina.
| Categoría | Ejecutar LLMs localmente |
| Tipo | Entorno de ejecución local (CLI) |
| Licencia | MIT |
| Ejecuta localmente | Sí |
| Construido con | Go |
| Nivel de habilidad | Principiante |
| Mejor para | desarrolladores que quieren una API de modelo local programable |
Otras herramientas de código abierto para ejecutar LLMs localmente que vale la pena comparar:
JanAplicación de escritorio estilo ChatGPT de código abierto y sin conexión
GPT4AllIA local privada que se ejecuta en CPU
llama.cppEl motor C/C++ que impulsa la inferencia local
LocalAIUna API de OpenAI que autohospedas
Text Generation WebUIInterfaz web rica en funciones para modelos locales
KoboldCppEjecutor de modelo local en un solo archivo
MLC LLMEjecutar LLMs en cualquier dispositivo, incluso teléfonos
llamafileUn archivo ejecutable = modelo + tiempo de ejecución
exoEjecuta grandes modelos en tus dispositivos cotidianos
CortexTiempo de ejecución estilo Ollama del equipo de Jan
Nexa SDKEjecuta cualquier modelo en cualquier dispositivo — CPU, GPU, NPU
RamaLamaEjecuta modelos como contenedores OCI
GPUStackGestiona clústeres de GPU para ejecutar modelosOllama es gratis y de código abierto (licencia MIT), por lo que puedes usarlo, autohospedarlo y modificarlo sin costo.
Sí. Ollama está diseñado para ejecutarse en tu propia máquina o servidor, manteniendo tus datos privados.
Las alternativas populares de código abierto incluyen LM Studio, Jan, GPT4All. Consulta las comparaciones anteriores para elegir.
Navega por el directorio completo de herramientas, modelos y proyectos de IA de código abierto, actualizado diariamente.
Navega todas las herramientas →