Inicio Proyectos pytorch-a2c-ppo-acktr-gail
pytorch-a2c-ppo-acktr-gail
Python

pytorch-a2c-ppo-acktr-gail

Implementación de PyTorch de Advantage Actor Critic (A2C), Optimización de Política Proximal (PPO), método de región de confianza escalable para aprendizaje por refuerzo profundo utilizando aproximación de Kronecker (ACKTR) y Aprendizaje por Imitación Generativa Antagónica (GAIL).

por ikostrikov · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Categoría
Lenguaje
a2cacktractor-criticMITPython
Ver en GitHub
En palabras simples

Implementa algoritmos de aprendizaje por refuerzo para entrenar modelos de IA en tareas como jugar videojuegos utilizando PyTorch.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
pytorch-a2c-ppo-acktr-gail — GitHub preview card
📈 Historial de estrellas
3 9033 901
2026-07-072026-08-31
📈 Sigue pytorch-a2c-ppo-acktr-gail

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Implementación de PyTorch de Advantage Actor Critic (A2C), Optimización de Política Proximal (PPO), método de región de confianza escalable para aprendizaje por refuerzo profundo utilizando aproximación de Kronecker (ACKTR) y Aprendizaje por Imitación Generativa Antagónica (GAIL).

pytorch-a2c-ppo-acktr-gail tiene 3.9k estrellas en GitHub. Se ha bifurcado 842 veces. pytorch-a2c-ppo-acktr-gail está escrito principalmente en Python. Se desarrolla activamente desde 2017. pytorch-a2c-ppo-acktr-gail está disponible bajo la licencia MIT. Sus temas principales son: a2c, acktr, actor-critic, advantage-actor-critic.

Frequently asked questions

¿Qué es pytorch-a2c-ppo-acktr-gail?

Implementación de PyTorch de Advantage Actor Critic (A2C), Optimización de Política Proximal (PPO), método de región de confianza escalable para aprendizaje por refuerzo profundo utilizando aproximación de Kronecker (ACKTR) y Aprendizaje por Imitación Generativa Antagónica (GAIL).

¿pytorch-a2c-ppo-acktr-gail es de código abierto?

pytorch-a2c-ppo-acktr-gail es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿pytorch-a2c-ppo-acktr-gail es gratis?

Sí. pytorch-a2c-ppo-acktr-gail es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está pytorch-a2c-ppo-acktr-gail?

pytorch-a2c-ppo-acktr-gail está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito pytorch-a2c-ppo-acktr-gail?

pytorch-a2c-ppo-acktr-gail está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — pytorch-a2c-ppo-acktr-gail

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=ikostrikov-pytorch-a2c-ppo-acktr-gail)](https://olud.ai/project/ikostrikov-pytorch-a2c-ppo-acktr-gail.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
pytorch-DRL
Implementaciones de PyTorch de varios algoritmos de Aprendizaje por Refuerzo Profundo (DRL) tan…
617 · a2c
comparteacktradvantage-actor-critic
DeepRL-Tutorials
Contiene implementaciones de alta calidad de algoritmos de Aprendizaje por Refuerzo Profundo es…
1.1k · a2c
comparteadvantage-actor-critica2c
cleanrl
Implementación de un solo archivo de alta calidad de algoritmos de Aprendizaje por Refuerzo Pro…
10.1k · a2c
comparteadvantage-actor-critica2c
Deep_reinforcement_learning_Course
Implementaciones del curso gratuito Aprendizaje por Refuerzo Profundo con Tensorflow y PyTorch
3.9k · a2c
compartea2cactor-critic
autonomous-learning-library
Una biblioteca de PyTorch para construir agentes de aprendizaje por refuerzo profundo.
655 · a2c
comparteadvantage-actor-critica2c
Deep-reinforcement-learning-with-pytorch
Implementación de DQN, AC, ACER, A2C, A3C, PG, DDPG, TRPO, PPO, SAC, TD3 y ....
4.6k · a2c
compartea2cactor-critic
Deep-Reinforcement-Learning-With-Python
Domina RL clásico, RL profundo, RL de distribución, RL inverso y más usando OpenAI Gym y Tensor…
474 · a2c
compartea2cactor-critic
Reinforcement-Learning
¡Aprende Aprendizaje por Refuerzo Profundo en 60 días! Clases y Código en Python. Aprendizaje p…
4.7k · a2c
compartea2c
reaver
Reaver: Marco Modular de Aprendizaje por Refuerzo Profundo. Enfocado en StarCraft II. Soporta G…
561 · actor-critic
comparteactor-critic
ElegantRL
Aprendizaje por Refuerzo Profundo Masivamente Paralelo. 🔥
4.3k · a2c

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.