Résoudre la Compréhension Visuelle avec des VLMs Renforcés
Utilisez un modèle pour comprendre les références visuelles dans les images et améliorer la compréhension du langage et des visuels par l'IA.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentRésoudre la Compréhension Visuelle avec des VLMs Renforcés
VLM-R1 compte 6k étoiles sur GitHub. Il a été forké 384 fois. VLM-R1 est écrit principalement en Python. Il est développé activement depuis 2025. VLM-R1 est disponible sous licence Apache-2.0. Ses principaux thèmes sont : deepseek-r1, grpo, llm, multimodal.
Résoudre la Compréhension Visuelle avec des VLMs Renforcés
VLM-R1 est un projet open source. Il est distribué sous licence Apache-2.0.
Oui. VLM-R1 est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
VLM-R1 est disponible sous licence Apache-2.0.
VLM-R1 est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/om-ai-lab-vlm-r1.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.