Calcula el requerimiento de tokens/s y memoria GPU para cualquier LLM. Soporta llama.cpp/ggml/bnb/QLoRA cuantización
Determinar la memoria GPU necesaria y métricas de rendimiento para ejecutar modelos de lenguaje en tu hardware.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasCalcula el requerimiento de tokens/s y memoria GPU para cualquier LLM. Soporta llama.cpp/ggml/bnb/QLoRA cuantización
gpu_poor tiene 1.4k estrellas en GitHub. Se ha bifurcado 88 veces. gpu_poor está escrito principalmente en JavaScript. Se desarrolla activamente desde 2023. Sus temas principales son: ggml, gpu, huggingface, language-model.
Calcula el requerimiento de tokens/s y memoria GPU para cualquier LLM. Soporta llama.cpp/ggml/bnb/QLoRA cuantización
gpu_poor es un proyecto de código abierto.
Sí. gpu_poor es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
gpu_poor está escrito principalmente en JavaScript.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/rahulschand-gpu-poor.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.