Servidor compatível com OpenAI e Anthropic para Apple Silicon. Execute LLMs e modelos de linguagem-visual (Llama, Qwen-VL, LLaVA) com agrupamento contínuo, chamada de ferramenta MCP e suporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona com Claude Code.
Execute vários modelos de IA em seu computador Apple para processar texto e imagens de forma eficiente.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserServidor compatível com OpenAI e Anthropic para Apple Silicon. Execute LLMs e modelos de linguagem-visual (Llama, Qwen-VL, LLaVA) com agrupamento contínuo, chamada de ferramenta MCP e suporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona com Claude Code.
vllm-mlx tem 1.5k estrelas no GitHub. Foi bifurcado 202 vezes. vllm-mlx é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. vllm-mlx está disponível sob a licença Apache-2.0. Os seus principais temas são: anthropic, apple-silicon, audio-processing, claude-code.
Servidor compatível com OpenAI e Anthropic para Apple Silicon. Execute LLMs e modelos de linguagem-visual (Llama, Qwen-VL, LLaVA) com agrupamento contínuo, chamada de ferramenta MCP e suporte multimodal. Backend MLX nativo, 400+ tok/s. Funciona com Claude Code.
vllm-mlx é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. vllm-mlx é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
vllm-mlx está disponível sob a licença Apache-2.0.
vllm-mlx é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://olud.ai/project/waybarrios-vllm-mlx.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.