Server di inferenza LLM ad alte prestazioni compatibile con OpenAI e Anthropic per Apple Silicon. MLX nativo, batching continuo, modelli multimodali, chiamata di strumenti MCP e supporto per Claude Code.
Eseguire vari modelli AI sul proprio computer Apple per elaborare testo e immagini in modo efficiente.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiServer di inferenza LLM ad alte prestazioni compatibile con OpenAI e Anthropic per Apple Silicon. MLX nativo, batching continuo, modelli multimodali, chiamata di strumenti MCP e supporto per Claude Code.
vllm-mlx ha 1.6k stelle su GitHub. È stato forkato 219 volte. vllm-mlx è scritto principalmente in Python. È in sviluppo attivo dal 2025. vllm-mlx è disponibile con licenza Apache-2.0. I suoi temi principali sono: anthropic, anthropic-api, apple-silicon, claude-code.
Server di inferenza LLM ad alte prestazioni compatibile con OpenAI e Anthropic per Apple Silicon. MLX nativo, batching continuo, modelli multimodali, chiamata di strumenti MCP e supporto per Claude Code.
vllm-mlx è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. vllm-mlx è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
vllm-mlx è disponibile con licenza Apache-2.0.
vllm-mlx è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/waybarrios-vllm-mlx.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.