Optimisation de politique de région de confiance avec TensorFlow et OpenAI Gym
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentOptimisation de politique de région de confiance avec TensorFlow et OpenAI Gym
trpo compte 364 étoiles sur GitHub. Il a été forké 106 fois. trpo est écrit principalement en Jupyter Notebook. Il est développé activement depuis 2017. trpo est disponible sous licence MIT. Ses principaux thèmes sont : machine-learning, mujoco, policy-gradient, reinforcement-learning.
Optimisation de politique de région de confiance avec TensorFlow et OpenAI Gym
trpo est un projet open source. Il est distribué sous licence MIT.
Oui. trpo est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
trpo est disponible sous licence MIT.
trpo est écrit principalement en Jupyter Notebook.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/pat-coady-trpo.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.