Home Progetti kvpress
kvpress
Python

kvpress

Compressione della cache KV per LLM resa semplice

di NVIDIA · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Categoria
Lingua
inferencekv-cachekv-cache-compressionApache-2.0Python
Visualizza su GitHub
In parole semplici

Comprimi l'uso della memoria per grandi modelli AI per renderli più facili da eseguire.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
kvpress — GitHub preview card
📈 Storia delle stelle
1.2k1.1k
2026-07-202026-08-31
📈 Segui kvpress

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Compressione della cache KV per LLM resa semplice

kvpress ha 1.2k stelle su GitHub. È stato forkato 172 volte. kvpress è scritto principalmente in Python. È in sviluppo attivo dal 2024. kvpress è disponibile con licenza Apache-2.0. I suoi temi principali sono: inference, kv-cache, kv-cache-compression, large-language-models.

Frequently asked questions

Che cos'è kvpress?

Compressione della cache KV per LLM resa semplice

kvpress è open source?

kvpress è un progetto open source. È rilasciato con licenza Apache-2.0.

kvpress è gratuito?

Sì. kvpress è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è kvpress?

kvpress è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto kvpress?

kvpress è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — kvpress

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-kvpress)](https://olud.ai/project/nvidia-kvpress.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.