Raggiungi prestazioni di inferenza all'avanguardia con acceleratori moderni su Kubernetes
Esegui modelli di linguaggio di grandi dimensioni in modo efficiente su Kubernetes, raggiungendo prestazioni elevate con vari acceleratori hardware.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiRaggiungi prestazioni di inferenza all'avanguardia con acceleratori moderni su Kubernetes
llm-d ha 3.9k stelle su GitHub. È stato forkato 639 volte. llm-d è scritto principalmente in Shell. È in sviluppo attivo dal 2025. llm-d è disponibile con licenza Apache-2.0. I suoi temi principali sono: ai, cncf, distributed-inference, gpu.
Raggiungi prestazioni di inferenza all'avanguardia con acceleratori moderni su Kubernetes
llm-d è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. llm-d è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
llm-d è disponibile con licenza Apache-2.0.
llm-d è scritto principalmente in Shell.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/llm-d-llm-d.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.