Servidor compatible con OpenAI y Anthropic para Apple Silicon. Ejecuta LLMs y modelos de lenguaje-visual (Llama, Qwen-VL, LLaVA) con agrupamiento continuo, llamada de herramientas MCP y soporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona con Claude Code.
Ejecuta varios modelos de IA en tu computadora Apple para procesar texto e imágenes de manera eficiente.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasServidor compatible con OpenAI y Anthropic para Apple Silicon. Ejecuta LLMs y modelos de lenguaje-visual (Llama, Qwen-VL, LLaVA) con agrupamiento continuo, llamada de herramientas MCP y soporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona con Claude Code.
vllm-mlx tiene 1.5k estrellas en GitHub. Se ha bifurcado 202 veces. vllm-mlx está escrito principalmente en Python. Se desarrolla activamente desde 2025. vllm-mlx está disponible bajo la licencia Apache-2.0. Sus temas principales son: anthropic, apple-silicon, audio-processing, claude-code.
Servidor compatible con OpenAI y Anthropic para Apple Silicon. Ejecuta LLMs y modelos de lenguaje-visual (Llama, Qwen-VL, LLaVA) con agrupamiento continuo, llamada de herramientas MCP y soporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona con Claude Code.
vllm-mlx es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. vllm-mlx es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
vllm-mlx está disponible bajo la licencia Apache-2.0.
vllm-mlx está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/waybarrios-vllm-mlx.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.