Início Projetos awesome-RLHF
awesome-RLHF
deep-learning

awesome-RLHF

Uma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)

por opendilab · GitHub
Estrelas
Forks
Tendências
Licença
Criado
Último commit
Categoria
deep-learningdeep-reinforcement-learninghuman-feedbackApache-2.0
Ver no GitHub
Em palavras simples

Navegue por uma coleção de artigos de pesquisa sobre o uso de feedback humano para melhorar modelos de aprendizado por reforço.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
awesome-RLHF — GitHub preview card
📈 Histórico de estrelas
4.42k4.41k
2026-07-072026-08-31
📈 Acompanhe awesome-RLHF

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Uma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)

awesome-RLHF tem 4.4k estrelas no GitHub. Foi bifurcado 259 vezes. Está em desenvolvimento ativo desde 2023. awesome-RLHF está disponível sob a licença Apache-2.0. Os seus principais temas são: deep-learning, deep-reinforcement-learning, human-feedback, large-language-models.

Frequently asked questions

O que é awesome-RLHF?

Uma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)

awesome-RLHF é de código aberto?

awesome-RLHF é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

awesome-RLHF é gratuito?

Sim. awesome-RLHF é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está awesome-RLHF?

awesome-RLHF está disponível sob a licença Apache-2.0.

🏅 Mantenedor deste projeto?
olud.ai badge — awesome-RLHF

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=opendilab-awesome-rlhf)](https://olud.ai/project/opendilab-awesome-rlhf.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
hands-on-rl
Curso gratuito que te leva do zero ao PRO em Aprendizado por Reforço 🦸🏻‍🦸🏽
1.6k · deep-reinforcement-learning
partilhadeep-reinforcement-learningreinforcement-learning
ABC-GRPO
Código para Adaptive-Boundary-Clipping GRPO. arxiv.org/pdf/2601.03895
442 · grpo
partilharlhfreinforcement-learning
drl-zh
Aprendizado por Reforço Profundo: Do Zero ao Herói!
2.3k · deep-learning
partilhadeep-reinforcement-learningreinforcement-learning
reward-learning-rl
[RSS 2019] Aprendizado por Reforço Robótico de Ponta a Ponta sem Engenharia de Recompensa
374 · deep-learning
partilhadeep-reinforcement-learningreinforcement-learning
MARL-Algorithms
Implementações de IQL, QMIX, VDN, COMA, QTRAN, MAVEN, CommNet, DyMA-CL e G2ANet no SMAC, o cená…
1.8k · deep-reinforcement-learning
partilhadeep-reinforcement-learningreinforcement-learning
DexterousHands
Esta é uma biblioteca que fornece tarefas de manipulação de mãos duais e destros através do Isa…
1.1k · deep-reinforcement-learning
partilhadeep-reinforcement-learningreinforcement-learning
gps
Busca Guiada de Políticas
600 · deep-learning
partilhadeep-reinforcement-learningreinforcement-learning
neural-symbolic-machines
Máquinas Simbólicas Neurais é uma estrutura para integrar redes neurais e representações simból…
385 · deep-learning
partilhadeep-reinforcement-learningreinforcement-learning
deep-rl-class
Este repositório contém o Curso de Aprendizado por Reforço Profundo da Hugging Face.
5k · deep-learning
partilhadeep-reinforcement-learningreinforcement-learning
awesome-deep-rl
Uma lista curada de recursos incríveis de Aprendizado por Reforço Profundo.
896 · awesome-list
partilhadeep-reinforcement-learningreinforcement-learning

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.