Um Framework de RL Agente fácil de usar, escalável e de alto desempenho baseado em Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
Construa e escale sistemas de aprendizado por reforço que aprendem com feedback humano usando uma estrutura fácil de usar.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserUm Framework de RL Agente fácil de usar, escalável e de alto desempenho baseado em Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
OpenRLHF tem 9.9k estrelas no GitHub. Foi bifurcado 989 vezes. OpenRLHF é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. OpenRLHF está disponível sob a licença Apache-2.0. Os seus principais temas são: large-language-models, proximal-policy-optimization, raylib, reinforcement-learning.
Um Framework de RL Agente fácil de usar, escalável e de alto desempenho baseado em Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)
OpenRLHF é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. OpenRLHF é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
OpenRLHF está disponível sob a licença Apache-2.0.
OpenRLHF é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/openrlhf-openrlhf.html)