Safe RLHF: Alinhamento de Valor Constrangido via Aprendizado por Reforço Seguro a partir de Feedback Humano
Treine modelos de IA usando feedback humano enquanto garante segurança e alinhamento com valores humanos.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserSafe RLHF: Alinhamento de Valor Constrangido via Aprendizado por Reforço Seguro a partir de Feedback Humano
safe-rlhf tem 1.6k estrelas no GitHub. Foi bifurcado 133 vezes. safe-rlhf é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. safe-rlhf está disponível sob a licença Apache-2.0. Os seus principais temas são: ai-safety, alpaca, beaver, datasets.
Safe RLHF: Alinhamento de Valor Constrangido via Aprendizado por Reforço Seguro a partir de Feedback Humano
safe-rlhf é um projeto de código aberto. É distribuído sob a licença Apache-2.0.
Sim. safe-rlhf é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
safe-rlhf está disponível sob a licença Apache-2.0.
safe-rlhf é escrito principalmente em Python.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/pku-alignment-safe-rlhf.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.