Accueil Projets VisionReasoner
VisionReasoner
Python

VisionReasoner

[ICLR 2026] VisionReasoner : Perception visuelle intégrée au raisonnement unifié via l'apprentissage par renforcement

par JIA-Lab-research · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
counting-objectsmultimodalmultimodal-large-language-modelsApache-2.0Python
Voir sur GitHub
En termes simples

Explorez des tâches visuelles avancées en utilisant un modèle IA unifié qui intègre raisonnement et perception.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
VisionReasoner — GitHub preview card
📈 Historique des étoiles
349348
2026-07-202026-08-31
📈 Suivez VisionReasoner

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

[ICLR 2026] VisionReasoner : Perception visuelle intégrée au raisonnement unifié via l'apprentissage par renforcement

VisionReasoner compte 348 étoiles sur GitHub. Il a été forké 15 fois. VisionReasoner est écrit principalement en Python. Il est développé activement depuis 2025. VisionReasoner est disponible sous licence Apache-2.0. Ses principaux thèmes sont : counting-objects, multimodal, multimodal-large-language-models, object-detection.

Frequently asked questions

Qu'est-ce que VisionReasoner ?

[ICLR 2026] VisionReasoner : Perception visuelle intégrée au raisonnement unifié via l'apprentissage par renforcement

VisionReasoner est-il open source ?

VisionReasoner est un projet open source. Il est distribué sous licence Apache-2.0.

VisionReasoner est-il gratuit ?

Oui. VisionReasoner est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est VisionReasoner ?

VisionReasoner est disponible sous licence Apache-2.0.

Dans quel langage VisionReasoner est-il écrit ?

VisionReasoner est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — VisionReasoner

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=jia-lab-research-visionreasoner)](https://olud.ai/project/jia-lab-research-visionreasoner.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implémentation officielle de Spatial-MLLM : Amélioration des Capacités…
477 · aigc
partagemultimodal-large-language-modelsmultimodal
Ovis
Une nouvelle architecture de Modèle de Langage Multimodal (MLLM), conçue pour aligner structure…
1.5k · chatbot
partagemultimodal-large-language-modelsmultimodal
EVF-SAM
Code officiel de "EVF-SAM : Fusion précoce vision-langage pour le modèle Segment Anything à com…
505 · multimodal
partagemultimodal-large-language-modelsmultimodal
PreciseRoIPooling
RoI Pooling précis avec support de gradient de coordonnées, proposé dans l'article "Acquisition…
781 · computer-vision
partageobject-detection
DeFCN
Détection d'Objets de Bout en Bout avec Réseau Convolutionnel Complet
494 · computer-vision
partageobject-detection
lvis-api
API Python pour le jeu de données LVIS
430 · computer-vision
partageobject-detection
mscnn
Implémentation Caffe de notre cadre de détection d'objets multi-échelles
408 · autonomous-driving
partageobject-detection
DINO
[ICLR 2023] Mise en œuvre officielle du papier "DINO : DETR avec des Boîtes d'Ancrage DeNoising…
2.8k · computer-vision
partageobject-detection
FastestDet
⚡ Un algorithme de détection de cible ultra léger sans ancre récemment conçu, pesant seulement…
856 · computer-vision
partageobject-detection
CenterNet-better
Une version facile à comprendre et de meilleure performance de CenterNet
545 · computer-vision
partageobject-detection

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.