Início Projetos VisionReasoner
VisionReasoner
Python

VisionReasoner

[ICLR 2026] VisionReasoner: Percepção Visual Integrada de Raciocínio Unificado via Aprendizado por Reforço

por JIA-Lab-research · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
counting-objectsmultimodalmultimodal-large-language-modelsApache-2.0Python
Ver no GitHub
Em palavras simples

Explore tarefas visuais avançadas usando um modelo de IA unificado que integra raciocínio e percepção.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
VisionReasoner — GitHub preview card
📈 Histórico de estrelas
349348
2026-07-202026-08-31
📈 Acompanhe VisionReasoner

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

[ICLR 2026] VisionReasoner: Percepção Visual Integrada de Raciocínio Unificado via Aprendizado por Reforço

VisionReasoner tem 348 estrelas no GitHub. Foi bifurcado 15 vezes. VisionReasoner é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. VisionReasoner está disponível sob a licença Apache-2.0. Os seus principais temas são: counting-objects, multimodal, multimodal-large-language-models, object-detection.

Frequently asked questions

O que é VisionReasoner?

[ICLR 2026] VisionReasoner: Percepção Visual Integrada de Raciocínio Unificado via Aprendizado por Reforço

VisionReasoner é de código aberto?

VisionReasoner é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

VisionReasoner é gratuito?

Sim. VisionReasoner é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está VisionReasoner?

VisionReasoner está disponível sob a licença Apache-2.0.

Em que linguagem VisionReasoner está escrito?

VisionReasoner é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — VisionReasoner

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=jia-lab-research-visionreasoner)](https://olud.ai/project/jia-lab-research-visionreasoner.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementação oficial do Spatial-MLLM: Aumentando as Capacidades de ML…
477 · aigc
partilhamultimodal-large-language-modelsmultimodal
Ovis
Uma nova arquitetura de Modelo de Linguagem Grande Multimodal (MLLM), projetada para alinhar es…
1.5k · chatbot
partilhamultimodal-large-language-modelsmultimodal
EVF-SAM
Código oficial de "EVF-SAM: Fusão Precoce de Visão-Linguagem para o Modelo Segmentar Qualquer C…
505 · multimodal
partilhamultimodal-large-language-modelsmultimodal
PreciseRoIPooling
Pooling de RoI preciso com suporte a gradiente de coordenadas, proposto no artigo "Aquisição de…
781 · computer-vision
partilhaobject-detection
DeFCN
Detecção de Objetos de Ponta a Ponta com Rede Convolucional Totalmente Convolucional
494 · computer-vision
partilhaobject-detection
lvis-api
API Python para o Conjunto de Dados LVIS
430 · computer-vision
partilhaobject-detection
mscnn
Implementação Caffe de nosso framework de detecção de objetos em múltiplas escalas
408 · autonomous-driving
partilhaobject-detection
DINO
[ICLR 2023] Implementação oficial do artigo "DINO: DETR com Melhorias nas Caixas de Ancoragem d…
2.8k · computer-vision
partilhaobject-detection
FastestDet
⚡ Um algoritmo de detecção de alvo ultra leve e sem âncoras recém-projetado, pesando apenas 250…
856 · computer-vision
partilhaobject-detection
CenterNet-better
Uma versão fácil de entender e com melhor desempenho do CenterNet
545 · computer-vision
partilhaobject-detection

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.