Alcance desempenho de inferência de ponta com aceleradores modernos no Kubernetes
Execute modelos de linguagem grandes de forma eficiente no Kubernetes, alcançando desempenho máximo com vários aceleradores de hardware.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserAlcance desempenho de inferência de ponta com aceleradores modernos no Kubernetes
llm-d tem 3.9k estrelas no GitHub. Foi bifurcado 639 vezes. llm-d é escrito principalmente em Shell. Está em desenvolvimento ativo desde 2025. llm-d está disponível sob a licença Apache-2.0. Os seus principais temas são: ai, cncf, distributed-inference, gpu.
Alcance desempenho de inferência de ponta com aceleradores modernos no Kubernetes
llm-d é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. llm-d é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
llm-d está disponível sob a licença Apache-2.0.
llm-d é escrito principalmente em Shell.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/llm-d-llm-d.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.