Inicio Proyectos kvpress
kvpress

kvpress

por NVIDIA · GitHub

Compresión de caché KV de LLM hecha fácil

Ver en GitHub
En palabras simples

Comprime el uso de memoria para grandes modelos de IA para hacerlos más fáciles de ejecutar.

⭐ Estrellas
🍴 Ramas
🔥 Tendencias
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
kvpress — GitHub preview card
📈 Historial de estrellas
1.15k1.14k
2026-07-202026-07-29
📈 Sigue kvpress

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Compresión de caché KV de LLM hecha fácil

kvpress tiene 1.1k estrellas en GitHub. Se ha bifurcado 164 veces. kvpress está escrito principalmente en Python. Se desarrolla activamente desde 2024. kvpress está disponible bajo la licencia Apache-2.0. Sus temas principales son: inference, kv-cache, kv-cache-compression, large-language-models.

Frequently asked questions

¿Qué es kvpress?

Compresión de caché KV de LLM hecha fácil

¿kvpress es de código abierto?

kvpress es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿kvpress es gratis?

Sí. kvpress es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está kvpress?

kvpress está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito kvpress?

kvpress está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — kvpress

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-kvpress)](https://olud.ai/project/nvidia-kvpress.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.