Uma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)
Navegue por uma coleção de artigos de pesquisa sobre o uso de feedback humano para melhorar modelos de aprendizado por reforço.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)
awesome-RLHF tem 4.4k estrelas no GitHub. Foi bifurcado 257 vezes. Está em desenvolvimento ativo desde 2023. awesome-RLHF está disponível sob a licença Apache-2.0. Os seus principais temas são: deep-learning, deep-reinforcement-learning, human-feedback, large-language-models.
Uma lista curada de recursos de aprendizado por reforço com feedback humano (atualizada continuamente)
awesome-RLHF é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. awesome-RLHF é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
awesome-RLHF está disponível sob a licença Apache-2.0.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/opendilab-awesome-rlhf.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.