Accueil Projets Flash-RL
Flash-RL
Python

Flash-RL

Implémentation pour le déploiement FP8/INT8 pour l'entraînement RL sans perte de performance.

par yaof20 · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
reinforcement-learningvllmMITPython
Voir sur GitHub
En termes simples

Entraînez rapidement des modèles d'apprentissage par renforcement en utilisant des techniques avancées sans perdre en performance.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
Flash-RL — GitHub preview card
📈 Historique des étoiles
307306
2026-07-202026-08-17
📈 Suivez Flash-RL

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Implémentation pour le déploiement FP8/INT8 pour l'entraînement RL sans perte de performance.

Flash-RL compte 306 étoiles sur GitHub. Il a été forké 23 fois. Flash-RL est écrit principalement en Python. Il est développé activement depuis 2025. Flash-RL est disponible sous licence MIT. Ses principaux thèmes sont : reinforcement-learning, vllm.

Frequently asked questions

Qu'est-ce que Flash-RL ?

Implémentation pour le déploiement FP8/INT8 pour l'entraînement RL sans perte de performance.

Flash-RL est-il open source ?

Flash-RL est un projet open source. Il est distribué sous licence MIT.

Flash-RL est-il gratuit ?

Oui. Flash-RL est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est Flash-RL ?

Flash-RL est disponible sous licence MIT.

Dans quel langage Flash-RL est-il écrit ?

Flash-RL est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — Flash-RL

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=yaof20-flash-rl)](https://olud.ai/project/yaof20-flash-rl.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
UniRL
UniRL est un cadre pour l'apprentissage par renforcement de modèle multimodal unifié.
820 · ai-infrastructure
partagevllmreinforcement-learning
PufferLib
Renforcement de l'apprentissage par renforcement
6.2k · reinforcement-learning
partagereinforcement-learning
sample-factory
Apprentissage par renforcement synchrone et asynchrone à haut débit
1k · reinforcement-learning
partagereinforcement-learning
hok_env
Honor of Kings AI Open Environment de Tencent
885 · reinforcement-learning
partagereinforcement-learning
Deep-Learning-Roadmap
:satellite: Ressources organisées pour les chercheurs et développeurs en apprentissage profond
3.2k · deep-learning
partagereinforcement-learning
baby-steps-of-rl-ja
Apprendre l'apprentissage par renforcement avec Python - De l'introduction à la pratique - Code…
453 · machine-learning
partagereinforcement-learning
reinforcement-learning-an-introduction
Solutions aux exercices dans Reinforcement Learning : An Introduction (2ème édition).
412 · python
partagereinforcement-learning
RoboBrain
[CVPR 2025] RoboBrain : Un modèle cérébral unifié pour la manipulation robotique de l'abstrait…
559 · embodied-ai
partagevllm
reinforcement-learning-an-introduction
Implémentation Python de l'apprentissage par renforcement : une introduction
14.7k · artificial-intelligence
partagereinforcement-learning
GOPS
Résolveur de problème de contrôle optimal général (GOPS), un package de solveur d'apprentissage…
304 · pytorch
partagereinforcement-learning

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.