Otimização de Política de Região de Confiança com TensorFlow e OpenAI Gym
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserOtimização de Política de Região de Confiança com TensorFlow e OpenAI Gym
trpo tem 364 estrelas no GitHub. Foi bifurcado 106 vezes. trpo é escrito principalmente em Jupyter Notebook. Está em desenvolvimento ativo desde 2017. trpo está disponível sob a licença MIT. Os seus principais temas são: machine-learning, mujoco, policy-gradient, reinforcement-learning.
Otimização de Política de Região de Confiança com TensorFlow e OpenAI Gym
trpo é um projeto de código aberto. É distribuído sob a licença MIT.
Sim. trpo é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
trpo está disponível sob a licença MIT.
trpo é escrito principalmente em Jupyter Notebook.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/pat-coady-trpo.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.