Una implementación de transformadores autoregresivos paralelos de modelo en GPUs, basada en las bibliotecas Megatron y DeepSpeed
Entrena modelos de lenguaje grande en tus propias GPU utilizando una colección de técnicas y optimizaciones.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUna implementación de transformadores autoregresivos paralelos de modelo en GPUs, basada en las bibliotecas Megatron y DeepSpeed
gpt-neox tiene 7.4k estrellas en GitHub. Se ha bifurcado 1.1k veces. gpt-neox está escrito principalmente en Python. Se desarrolla activamente desde 2020. gpt-neox está disponible bajo la licencia Apache-2.0. Sus temas principales son: deepspeed-library, gpt-3, language-model, transformers.
Una implementación de transformadores autoregresivos paralelos de modelo en GPUs, basada en las bibliotecas Megatron y DeepSpeed
gpt-neox es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. gpt-neox es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
gpt-neox está disponible bajo la licencia Apache-2.0.
gpt-neox está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/eleutherai-gpt-neox.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.