Inicio Proyectos rlhf-book
rlhf-book
Python

rlhf-book

Libro de texto sobre aprendizaje por refuerzo a partir de retroalimentación humana

por natolambert · GitHub
Estrellas
Ramas
Creado
Último commit
Categoría
Lenguaje
aialignmentrlhfPython
Ver en GitHub
En palabras simples

Lee una guía completa sobre cómo usar el aprendizaje por refuerzo con retroalimentación humana para modelos de lenguaje.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
rlhf-book — GitHub preview card
📈 Historial de estrellas
2.2k2.1k
2026-07-072026-08-31
📈 Sigue rlhf-book

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Libro de texto sobre aprendizaje por refuerzo a partir de retroalimentación humana

rlhf-book tiene 2.2k estrellas en GitHub. Se ha bifurcado 230 veces. rlhf-book está escrito principalmente en Python. Se desarrolla activamente desde 2024. Sus temas principales son: ai, alignment, rlhf.

Frequently asked questions

¿Qué es rlhf-book?

Libro de texto sobre aprendizaje por refuerzo a partir de retroalimentación humana

¿rlhf-book es de código abierto?

rlhf-book es un proyecto de código abierto.

¿rlhf-book es gratis?

Sí. rlhf-book es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿En qué lenguaje está escrito rlhf-book?

rlhf-book está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — rlhf-book

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=natolambert-rlhf-book)](https://olud.ai/project/natolambert-rlhf-book.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.