Home Progetti R1-VL
R1-VL

R1-VL

di jingyi0000 · GitHub

R1-VL: Apprendere a ragionare con modelli di linguaggio multimodali di grandi dimensioni tramite ottimizzazione della politica relativa a gruppi passo-passo

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Licenza non specificata
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
R1-VL — GitHub preview card
📈 Storia delle stelle
353352
2026-07-202026-07-29
📈 Segui R1-VL

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

R1-VL: Apprendere a ragionare con modelli di linguaggio multimodali di grandi dimensioni tramite ottimizzazione della politica relativa a gruppi passo-passo

R1-VL ha 352 stelle su GitHub. È stato forkato 2 volte. R1-VL è scritto principalmente in Python. È in sviluppo attivo dal 2025. I suoi temi principali sono: mllm, multimodal-large-language-models, r1, reasoning.

Frequently asked questions

Che cos'è R1-VL?

R1-VL: Apprendere a ragionare con modelli di linguaggio multimodali di grandi dimensioni tramite ottimizzazione della politica relativa a gruppi passo-passo

R1-VL è open source?

R1-VL è un progetto open source.

R1-VL è gratuito?

Sì. R1-VL è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto R1-VL?

R1-VL è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — R1-VL

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=jingyi0000-r1-vl)](https://opensourceai.tech/project/jingyi0000-r1-vl.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
OmniVinci
OmniVinci è un LLM omni-modale per la comprensione congiunta di visione, audio e linguaggio.
675 · audio-language-model
condividemultimodal-large-language-modelsvision-language-model
cambrian-s
Cambrian-S: Verso il Supersensing Spaziale nel Video
563 · computer-vision
condividemultimodal-large-language-modelsvision-language-model
colette
RAG multimodale per cercare e interagire localmente con documenti tecnici di qualsiasi tipo
301 · llm
condividemultimodal-large-language-modelsvision-language-model
AlphaDrive
Liberare il potere dei VLM in guida autonoma tramite apprendimento per rinforzo e ragionamento
332 · autonomous-driving
condividereasoningvision-language-model
Woodpecker
✨✨Woodpecker: Correzione delle allucinazioni per modelli di linguaggio multimodali di grandi di…
649 · hallucination
condividemllmmultimodal-large-language-models
mPLUG-DocOwl
mPLUG-DocOwl: Modello di linguaggio multimodale modularizzato per la comprensione dei documenti
2.4k · chart-understanding
condividemllmmultimodal-large-language-models
Groma
[ECCV2024] Modello di linguaggio multimodale ancorato con tokenizzazione visiva localizzata
585 · foundation-models
condividemllmvision-language-model
NEO
NEO Series: Modelli di visione-linguaggio nativi dai principi fondamentali
878 · agi
condividemllmmultimodal-large-language-models
Ovis
Un'architettura innovativa di Modello di Linguaggio Multimodale (MLLM), progettata per allinear…
1.5k · chatbot
condividemultimodal-large-language-modelsvision-language-model
EVE
EVE Series: Modelli Vision-Language senza encoder da BAAI
376 · clip
condividemllmmultimodal-large-language-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.