Inicio Proyectos awesome-RLHF
awesome-RLHF
deep-learning

awesome-RLHF

Una lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)

por opendilab · GitHub
Estrellas
Ramas
Tendencias
Licencia
Creado
Último commit
Categoría
deep-learningdeep-reinforcement-learninghuman-feedbackApache-2.0
Ver en GitHub
En palabras simples

Navega por una colección de documentos de investigación sobre el uso de retroalimentación humana para mejorar modelos de aprendizaje por refuerzo.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
awesome-RLHF — GitHub preview card
📈 Historial de estrellas
4.42k4.41k
2026-07-072026-08-31
📈 Sigue awesome-RLHF

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Una lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)

awesome-RLHF tiene 4.4k estrellas en GitHub. Se ha bifurcado 259 veces. Se desarrolla activamente desde 2023. awesome-RLHF está disponible bajo la licencia Apache-2.0. Sus temas principales son: deep-learning, deep-reinforcement-learning, human-feedback, large-language-models.

Frequently asked questions

¿Qué es awesome-RLHF?

Una lista curada de recursos de aprendizaje por refuerzo con retroalimentación humana (actualizada continuamente)

¿awesome-RLHF es de código abierto?

awesome-RLHF es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿awesome-RLHF es gratis?

Sí. awesome-RLHF es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está awesome-RLHF?

awesome-RLHF está disponible bajo la licencia Apache-2.0.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — awesome-RLHF

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=opendilab-awesome-rlhf)](https://olud.ai/project/opendilab-awesome-rlhf.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
hands-on-rl
Curso gratuito que te lleva de cero a PRO en Aprendizaje por Refuerzo 🦸🏻‍🦸🏽
1.6k · deep-reinforcement-learning
compartedeep-reinforcement-learningreinforcement-learning
ABC-GRPO
Código para Adaptive-Boundary-Clipping GRPO. arxiv.org/pdf/2601.03895
442 · grpo
comparterlhfreinforcement-learning
drl-zh
Aprendizaje por refuerzo profundo: ¡De cero a héroe!
2.3k · deep-learning
compartedeep-reinforcement-learningreinforcement-learning
reward-learning-rl
[RSS 2019] Aprendizaje por refuerzo robótico de extremo a extremo sin ingeniería de recompensas
374 · deep-learning
compartedeep-reinforcement-learningreinforcement-learning
MARL-Algorithms
Implementaciones de IQL, QMIX, VDN, COMA, QTRAN, MAVEN, CommNet, DyMA-CL, y G2ANet en SMAC, el…
1.8k · deep-reinforcement-learning
compartedeep-reinforcement-learningreinforcement-learning
DexterousHands
Esta es una biblioteca que proporciona tareas de manipulación de manos duales hábiles a través…
1.1k · deep-reinforcement-learning
compartedeep-reinforcement-learningreinforcement-learning
gps
Búsqueda Guiada de Políticas
600 · deep-learning
compartedeep-reinforcement-learningreinforcement-learning
neural-symbolic-machines
Las Máquinas Simbólicas Neurales son un marco para integrar redes neuronales y representaciones…
385 · deep-learning
compartedeep-reinforcement-learningreinforcement-learning
deep-rl-class
Este repositorio contiene el Curso de Aprendizaje por Refuerzo Profundo de Hugging Face.
5k · deep-learning
compartedeep-reinforcement-learningreinforcement-learning
awesome-deep-rl
Una lista curada de recursos impresionantes de Aprendizaje por Refuerzo Profundo.
896 · awesome-list
compartedeep-reinforcement-learningreinforcement-learning

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.