Optimización de Políticas de Región de Confianza con TensorFlow y OpenAI Gym.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasOptimización de Políticas de Región de Confianza con TensorFlow y OpenAI Gym.
trpo tiene 364 estrellas en GitHub. Se ha bifurcado 106 veces. trpo está escrito principalmente en Jupyter Notebook. Se desarrolla activamente desde 2017. trpo está disponible bajo la licencia MIT. Sus temas principales son: machine-learning, mujoco, policy-gradient, reinforcement-learning.
Optimización de Políticas de Región de Confianza con TensorFlow y OpenAI Gym.
trpo es un proyecto de código abierto. Se distribuye bajo la licencia MIT.
Sí. trpo es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
trpo está disponible bajo la licencia MIT.
trpo está escrito principalmente en Jupyter Notebook.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/pat-coady-trpo.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.