Una biblioteca para acelerar modelos Transformer en GPUs NVIDIA, incluyendo el uso de precisión de punto flotante de 8 bits y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para proporcionar un mejor rendimiento con menor utilización de memoria tanto en entrenamiento como en inferencia.
Acelera el entrenamiento de modelos de IA en tarjetas gráficas NVIDIA mientras usas menos memoria.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUna biblioteca para acelerar modelos Transformer en GPUs NVIDIA, incluyendo el uso de precisión de punto flotante de 8 bits y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para proporcionar un mejor rendimiento con menor utilización de memoria tanto en entrenamiento como en inferencia.
TransformerEngine tiene 3.5k estrellas en GitHub. Se ha bifurcado 784 veces. TransformerEngine está escrito principalmente en Python. Se desarrolla activamente desde 2022. TransformerEngine está disponible bajo la licencia Apache-2.0. Sus temas principales son: cuda, deep-learning, fp4, fp8.
Una biblioteca para acelerar modelos Transformer en GPUs NVIDIA, incluyendo el uso de precisión de punto flotante de 8 bits y 4 bits (FP8 y FP4) en GPUs Hopper, Ada y Blackwell, para proporcionar un mejor rendimiento con menor utilización de memoria tanto en entrenamiento como en inferencia.
TransformerEngine es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. TransformerEngine es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
TransformerEngine está disponible bajo la licencia Apache-2.0.
TransformerEngine está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/nvidia-transformerengine.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.