Startseite Projekte R1-VL
R1-VL

R1-VL

von jingyi0000 · GitHub

R1-VL: Lernen zu argumentieren mit multimodalen großen Sprachmodellen durch schrittweise gruppenrelative Politikoptimierung

Auf GitHub ansehen
⭐ Sterne
🍴 Forks
📜 Lizenz
Lizenz nicht angegeben
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
R1-VL — GitHub preview card
📈 Sternhistorie
353352
2026-07-202026-07-29
📈 R1-VL verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

R1-VL: Lernen zu argumentieren mit multimodalen großen Sprachmodellen durch schrittweise gruppenrelative Politikoptimierung

R1-VL hat 352 Sterne auf GitHub. Es wurde 2-mal geforkt. R1-VL ist hauptsächlich in Python geschrieben. Es wird seit 2025 aktiv entwickelt. Die Hauptthemen sind: mllm, multimodal-large-language-models, r1, reasoning.

Frequently asked questions

Was ist R1-VL?

R1-VL: Lernen zu argumentieren mit multimodalen großen Sprachmodellen durch schrittweise gruppenrelative Politikoptimierung

Ist R1-VL Open Source?

R1-VL ist ein Open-Source-Projekt.

Ist R1-VL kostenlos?

Ja. R1-VL ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

In welcher Sprache ist R1-VL geschrieben?

R1-VL ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — R1-VL

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=jingyi0000-r1-vl)](https://opensourceai.tech/project/jingyi0000-r1-vl.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
OmniVinci
OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache…
675 · audio-language-model
teiltmultimodal-large-language-modelsvision-language-model
cambrian-s
Cambrian-S: Auf dem Weg zu räumlichem Supersensing in Video
563 · computer-vision
teiltmultimodal-large-language-modelsvision-language-model
colette
Multimodales RAG, um lokal mit technischen Dokumenten jeglicher Art zu suchen und zu interagier…
301 · llm
teiltmultimodal-large-language-modelsvision-language-model
AlphaDrive
Die Macht der VLMs im autonomen Fahren durch Verstärkungslernen und Schlussfolgerungen entfesse…
332 · autonomous-driving
teiltreasoningvision-language-model
Woodpecker
✨✨Woodpecker: Halluzinationskorrektur für multimodale große Sprachmodelle
649 · hallucination
teiltmllmmultimodal-large-language-models
mPLUG-DocOwl
mPLUG-DocOwl: Modularisiertes multimodales großes Sprachmodell für das Dokumentenverständnis
2.4k · chart-understanding
teiltmllmmultimodal-large-language-models
Groma
[ECCV2024] Grounded Multimodal Large Language Model mit lokalisierter visueller Tokenisierung
585 · foundation-models
teiltmllmvision-language-model
NEO
NEO-Serie: Native Vision-Language-Modelle aus ersten Prinzipien
878 · agi
teiltmllmmultimodal-large-language-models
Ovis
Eine neuartige Multimodale Large Language Model (MLLM) Architektur, die darauf ausgelegt ist, v…
1.5k · chatbot
teiltmultimodal-large-language-modelsvision-language-model
EVE
EVE-Serie: Encoder-freie Vision-Sprachmodelle von BAAI
376 · clip
teiltmllmmultimodal-large-language-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.