Accueil Projets MixGRPO
MixGRPO
Python

MixGRPO

[ECCV 2026] MixGRPO : Déverrouillage de l'efficacité GRPO basée sur le flux avec ODE-SDE mixte

par Tencent-Hunyuan · GitHub
Étoiles
Forks
Créé
Dernier commit
Catégorie
Langue
diffusiongrporeinforcement-learningPython
Voir sur GitHub
En termes simples

Réalisez des expériences sur des modèles basés sur le flux pour améliorer l'efficacité dans les tâches d'apprentissage par renforcement.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
MixGRPO — GitHub preview card
📈 Historique des étoiles
1 1521 151
2026-07-202026-08-31
📈 Suivez MixGRPO

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

[ECCV 2026] MixGRPO : Déverrouillage de l'efficacité GRPO basée sur le flux avec ODE-SDE mixte

MixGRPO compte 1.2k étoiles sur GitHub. Il a été forké 50 fois. MixGRPO est écrit principalement en Python. Il est développé activement depuis 2025. Ses principaux thèmes sont : diffusion, grpo, reinforcement-learning.

Frequently asked questions

Qu'est-ce que MixGRPO ?

[ECCV 2026] MixGRPO : Déverrouillage de l'efficacité GRPO basée sur le flux avec ODE-SDE mixte

MixGRPO est-il open source ?

MixGRPO est un projet open source.

MixGRPO est-il gratuit ?

Oui. MixGRPO est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage MixGRPO est-il écrit ?

MixGRPO est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — MixGRPO

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=tencent-hunyuan-mixgrpo)](https://olud.ai/project/tencent-hunyuan-mixgrpo.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
ABC-GRPO
Code pour le clipping de frontière adaptatif GRPO. arxiv.org/pdf/2601.03895
442 · grpo
partagegrporeinforcement-learning
Flow-Factory
Un cadre unifié pour un apprentissage par renforcement facile dans les modèles de correspondanc…
629 · diffusion
partagediffusionreinforcement-learning
Awesome-RL-for-Video-Generation
Une liste soigneusement sélectionnée de documents sur l'apprentissage par renforcement pour la…
565 · dpo
partagegrporeinforcement-learning
OpenThinkIMG
OpenThinkIMG est un cadre open-source de bout en bout qui permet aux LVLM de penser avec des im…
397 · grpo
partagegrporeinforcement-learning
VADER
Alignement de diffusion vidéo via des gradients de récompense. Nous améliorons une variété de m…
315 · alignment
partagediffusionreinforcement-learning
MegaDLMs
Cadre optimisé pour GPU pour l'entraînement de modèles de langage de diffusion à n'importe quel…
344 · diffusion
partagediffusion
REPA
[ICLR'25 Oral] Alignement de représentation pour la génération : Entraîner des transformateurs…
1.7k · diffusion
partagediffusion
StyleKeeper
Implémentation officielle de Pytorch de "StyleKeeper : Prévenir les fuites de contenu en utilis…
483 · diffusion
partagediffusion
PufferLib
Renforcement de l'apprentissage par renforcement
6.2k · reinforcement-learning
partagereinforcement-learning
sample-factory
Apprentissage par renforcement synchrone et asynchrone à haut débit
1k · reinforcement-learning
partagereinforcement-learning

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.