Accueil Projets R1-VL
R1-VL

R1-VL

par jingyi0000 · GitHub

R1-VL : Apprendre à raisonner avec des modèles de langage multimodaux via l'optimisation de politique relative de groupe étape par étape

Voir sur GitHub
⭐ Étoiles
🍴 Forks
📜 Licence
Licence non spécifiée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
R1-VL — GitHub preview card
📈 Historique des étoiles
353352
2026-07-202026-07-29
📈 Suivez R1-VL

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

R1-VL : Apprendre à raisonner avec des modèles de langage multimodaux via l'optimisation de politique relative de groupe étape par étape

R1-VL compte 352 étoiles sur GitHub. Il a été forké 2 fois. R1-VL est écrit principalement en Python. Il est développé activement depuis 2025. Ses principaux thèmes sont : mllm, multimodal-large-language-models, r1, reasoning.

Frequently asked questions

Qu'est-ce que R1-VL ?

R1-VL : Apprendre à raisonner avec des modèles de langage multimodaux via l'optimisation de politique relative de groupe étape par étape

R1-VL est-il open source ?

R1-VL est un projet open source.

R1-VL est-il gratuit ?

Oui. R1-VL est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Dans quel langage R1-VL est-il écrit ?

R1-VL est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
OpenSourceAI badge — R1-VL

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=jingyi0000-r1-vl)](https://opensourceai.tech/project/jingyi0000-r1-vl.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
OmniVinci
OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du…
675 · audio-language-model
partagemultimodal-large-language-modelsvision-language-model
cambrian-s
Cambrian-S : Vers une supersensibilité spatiale dans la vidéo
563 · computer-vision
partagemultimodal-large-language-modelsvision-language-model
colette
RAG multimodal pour rechercher et interagir localement avec des documents techniques de tout ty…
301 · llm
partagemultimodal-large-language-modelsvision-language-model
AlphaDrive
Libérer la puissance des VLMs dans la conduite autonome via l'apprentissage par renforcement et…
332 · autonomous-driving
partagereasoningvision-language-model
Woodpecker
✨✨Woodpecker : Correction des hallucinations pour les modèles de langage multimodaux de grande…
649 · hallucination
partagemllmmultimodal-large-language-models
mPLUG-DocOwl
mPLUG-DocOwl : Modèle de langage multimodal modularisé pour la compréhension de documents
2.4k · chart-understanding
partagemllmmultimodal-large-language-models
Groma
[ECCV2024] Modèle de langage multimodal ancré avec tokenisation visuelle localisée
585 · foundation-models
partagemllmvision-language-model
NEO
Série NEO : Modèles vision-langage natifs basés sur des principes fondamentaux
878 · agi
partagemllmmultimodal-large-language-models
Ovis
Une nouvelle architecture de Modèle de Langage Multimodal (MLLM), conçue pour aligner structure…
1.5k · chatbot
partagemultimodal-large-language-modelsvision-language-model
EVE
Série EVE : Modèles Vision-Language sans encodeur de BAAI
376 · clip
partagemllmmultimodal-large-language-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.