Inicio Proyectos VisionReasoner
VisionReasoner
Python

VisionReasoner

[ICLR 2026] VisionReasoner: Percepción Visual Integrada en Razonamiento Unificado a través del Aprendizaje por Refuerzo

por JIA-Lab-research · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
counting-objectsmultimodalmultimodal-large-language-modelsApache-2.0Python
Ver en GitHub
En palabras simples

Explora tareas visuales avanzadas utilizando un modelo de IA unificado que integra razonamiento y percepción.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
VisionReasoner — GitHub preview card
📈 Historial de estrellas
349348
2026-07-202026-08-31
📈 Sigue VisionReasoner

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

[ICLR 2026] VisionReasoner: Percepción Visual Integrada en Razonamiento Unificado a través del Aprendizaje por Refuerzo

VisionReasoner tiene 348 estrellas en GitHub. Se ha bifurcado 15 veces. VisionReasoner está escrito principalmente en Python. Se desarrolla activamente desde 2025. VisionReasoner está disponible bajo la licencia Apache-2.0. Sus temas principales son: counting-objects, multimodal, multimodal-large-language-models, object-detection.

Frequently asked questions

¿Qué es VisionReasoner?

[ICLR 2026] VisionReasoner: Percepción Visual Integrada en Razonamiento Unificado a través del Aprendizaje por Refuerzo

¿VisionReasoner es de código abierto?

VisionReasoner es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿VisionReasoner es gratis?

Sí. VisionReasoner es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está VisionReasoner?

VisionReasoner está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito VisionReasoner?

VisionReasoner está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — VisionReasoner

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=jia-lab-research-visionreasoner)](https://olud.ai/project/jia-lab-research-visionreasoner.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementación oficial de Spatial-MLLM: Mejorando las Capacidades de M…
477 · aigc
compartemultimodal-large-language-modelsmultimodal
Ovis
Una nueva arquitectura de Modelo de Lenguaje Multimodal Grande (MLLM), diseñada para alinear es…
1.5k · chatbot
compartemultimodal-large-language-modelsmultimodal
EVF-SAM
Código oficial de "EVF-SAM: Fusión Temprana de Visión-Lenguaje para el Modelo Segmenta Cualquie…
505 · multimodal
compartemultimodal-large-language-modelsmultimodal
PreciseRoIPooling
Agrupación precisa de RoI con soporte de gradiente de coordenadas, propuesto en el artículo "Ad…
781 · computer-vision
comparteobject-detection
DeFCN
Detección de Objetos de Extremo a Extremo con Red Convolucional Totalmente Convolucional
494 · computer-vision
comparteobject-detection
lvis-api
API de Python para el Conjunto de Datos LVIS
430 · computer-vision
comparteobject-detection
mscnn
Implementación en Caffe de nuestro marco de detección de objetos a múltiples escalas
408 · autonomous-driving
comparteobject-detection
DINO
[ICLR 2023] Implementación oficial del artículo "DINO: DETR con Cajas de Anclaje de Desruido Me…
2.8k · computer-vision
comparteobject-detection
FastestDet
⚡ Un algoritmo de detección de objetivos sin anclaje ultraligero recién diseñado, pesa solo 250…
856 · computer-vision
comparteobject-detection
CenterNet-better
Una versión fácil de entender y de mejor rendimiento de CenterNet
545 · computer-vision
comparteobject-detection

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.