Logra un rendimiento de inferencia de última generación con aceleradores modernos en Kubernetes
Ejecuta modelos de lenguaje grandes de manera eficiente en Kubernetes, logrando un rendimiento óptimo con varios aceleradores de hardware.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasLogra un rendimiento de inferencia de última generación con aceleradores modernos en Kubernetes
llm-d tiene 3.9k estrellas en GitHub. Se ha bifurcado 639 veces. llm-d está escrito principalmente en Shell. Se desarrolla activamente desde 2025. llm-d está disponible bajo la licencia Apache-2.0. Sus temas principales son: ai, cncf, distributed-inference, gpu.
Logra un rendimiento de inferencia de última generación con aceleradores modernos en Kubernetes
llm-d es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. llm-d es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
llm-d está disponible bajo la licencia Apache-2.0.
llm-d está escrito principalmente en Shell.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/llm-d-llm-d.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.