Safe RLHF: Allineamento del valore vincolato tramite Reinforcement Learning sicuro da feedback umano
Allena modelli AI utilizzando feedback umano garantendo sicurezza e allineamento con i valori umani.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiSafe RLHF: Allineamento del valore vincolato tramite Reinforcement Learning sicuro da feedback umano
safe-rlhf ha 1.6k stelle su GitHub. È stato forkato 133 volte. safe-rlhf è scritto principalmente in Python. È in sviluppo attivo dal 2023. safe-rlhf è disponibile con licenza Apache-2.0. I suoi temi principali sono: ai-safety, alpaca, beaver, datasets.
Safe RLHF: Allineamento del valore vincolato tramite Reinforcement Learning sicuro da feedback umano
safe-rlhf è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. safe-rlhf è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
safe-rlhf è disponibile con licenza Apache-2.0.
safe-rlhf è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/pku-alignment-safe-rlhf.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.