Una lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)
Navega por una colección de documentos de investigación sobre el uso de retroalimentación humana para mejorar modelos de aprendizaje por refuerzo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasUna lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)
awesome-RLHF tiene 4.4k estrellas en GitHub. Se ha bifurcado 257 veces. Se desarrolla activamente desde 2023. awesome-RLHF está disponible bajo la licencia Apache-2.0. Sus temas principales son: deep-learning, deep-reinforcement-learning, human-feedback, large-language-models.
Una lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)
awesome-RLHF es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. awesome-RLHF es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
awesome-RLHF está disponible bajo la licencia Apache-2.0.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/opendilab-awesome-rlhf.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.