Ottimizzazione della politica della regione di fiducia con TensorFlow e OpenAI Gym
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiOttimizzazione della politica della regione di fiducia con TensorFlow e OpenAI Gym
trpo ha 364 stelle su GitHub. È stato forkato 106 volte. trpo è scritto principalmente in Jupyter Notebook. È in sviluppo attivo dal 2017. trpo è disponibile con licenza MIT. I suoi temi principali sono: machine-learning, mujoco, policy-gradient, reinforcement-learning.
Ottimizzazione della politica della regione di fiducia con TensorFlow e OpenAI Gym
trpo è un progetto open source. È rilasciato con licenza MIT.
Sì. trpo è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
trpo è disponibile con licenza MIT.
trpo è scritto principalmente in Jupyter Notebook.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/pat-coady-trpo.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.