[ICLR 2026] Búsqueda de Árbol para Aprendizaje por Refuerzo de Agentes LLM
Implementa una estrategia de búsqueda en árbol para entrenar modelos de lenguaje grandes en tareas de aprendizaje por refuerzo.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quieras[ICLR 2026] Búsqueda de Árbol para Aprendizaje por Refuerzo de Agentes LLM
Tree-GRPO tiene 385 estrellas en GitHub. Se ha bifurcado 38 veces. Tree-GRPO está escrito principalmente en Python. Se desarrolla activamente desde 2025. Tree-GRPO está disponible bajo la licencia Apache-2.0. Sus temas principales son: agent, large-language-model, llm, reinforcement-learning.
[ICLR 2026] Búsqueda de Árbol para Aprendizaje por Refuerzo de Agentes LLM
Tree-GRPO es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. Tree-GRPO es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Tree-GRPO está disponible bajo la licencia Apache-2.0.
Tree-GRPO está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/amap-ml-tree-grpo.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.