Risolvi la Comprensione Visiva con VLM rinforzati
Usa un modello per comprendere riferimenti visivi nelle immagini e migliorare la comprensione dell'AI del linguaggio e dei visual insieme.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiRisolvi la Comprensione Visiva con VLM rinforzati
VLM-R1 ha 6k stelle su GitHub. È stato forkato 384 volte. VLM-R1 è scritto principalmente in Python. È in sviluppo attivo dal 2025. VLM-R1 è disponibile con licenza Apache-2.0. I suoi temi principali sono: deepseek-r1, grpo, llm, multimodal.
Risolvi la Comprensione Visiva con VLM rinforzati
VLM-R1 è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. VLM-R1 è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
VLM-R1 è disponibile con licenza Apache-2.0.
VLM-R1 è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/om-ai-lab-vlm-r1.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.