Safe RLHF: Alineación de Valor Constrida a través de Aprendizaje por Refuerzo Seguro a partir de Retroalimentación Humana
Entrena modelos de IA utilizando retroalimentación humana mientras aseguras la seguridad y la alineación con los valores humanos.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasSafe RLHF: Alineación de Valor Constrida a través de Aprendizaje por Refuerzo Seguro a partir de Retroalimentación Humana
safe-rlhf tiene 1.6k estrellas en GitHub. Se ha bifurcado 133 veces. safe-rlhf está escrito principalmente en Python. Se desarrolla activamente desde 2023. safe-rlhf está disponible bajo la licencia Apache-2.0. Sus temas principales son: ai-safety, alpaca, beaver, datasets.
Safe RLHF: Alineación de Valor Constrida a través de Aprendizaje por Refuerzo Seguro a partir de Retroalimentación Humana
safe-rlhf es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. safe-rlhf es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
safe-rlhf está disponible bajo la licencia Apache-2.0.
safe-rlhf está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/pku-alignment-safe-rlhf.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.