[ICLR 2026] Ricerca ad Albero per l'Apprendimento per Rinforzo degli Agenti LLM
Implementa una strategia di ricerca ad albero per l'addestramento di modelli di linguaggio di grandi dimensioni in compiti di apprendimento per rinforzo.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi[ICLR 2026] Ricerca ad Albero per l'Apprendimento per Rinforzo degli Agenti LLM
Tree-GRPO ha 385 stelle su GitHub. È stato forkato 38 volte. Tree-GRPO è scritto principalmente in Python. È in sviluppo attivo dal 2025. Tree-GRPO è disponibile con licenza Apache-2.0. I suoi temi principali sono: agent, large-language-model, llm, reinforcement-learning.
[ICLR 2026] Ricerca ad Albero per l'Apprendimento per Rinforzo degli Agenti LLM
Tree-GRPO è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. Tree-GRPO è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
Tree-GRPO è disponibile con licenza Apache-2.0.
Tree-GRPO è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/amap-ml-tree-grpo.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.