Resolver la Comprensión Visual con VLMs Reforzados
Usa un modelo para entender referencias visuales en imágenes y mejorar la comprensión de la IA sobre el lenguaje y los visuales juntos.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasResolver la Comprensión Visual con VLMs Reforzados
VLM-R1 tiene 6k estrellas en GitHub. Se ha bifurcado 384 veces. VLM-R1 está escrito principalmente en Python. Se desarrolla activamente desde 2025. VLM-R1 está disponible bajo la licencia Apache-2.0. Sus temas principales son: deepseek-r1, grpo, llm, multimodal.
Resolver la Comprensión Visual con VLMs Reforzados
VLM-R1 es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. VLM-R1 es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
VLM-R1 está disponible bajo la licencia Apache-2.0.
VLM-R1 está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/om-ai-lab-vlm-r1.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.