Startseite Projekte OmniVinci
OmniVinci

OmniVinci

von NVlabs · GitHub

OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.

Auf GitHub ansehen
In einfachen Worten

Verstehen und analysieren Sie Informationen aus Bildern, Audio und Text zusammen mit einem multimodalen KI-Modell.

⭐ Sterne
🍴 Forks
🔥 Trendend
📜 Lizenz
Kommerzielle Nutzung erlaubt
📅 Erstellt
🔄 Letzter Commit
🏷️ Kategorie
💻 Sprache
Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
OmniVinci — GitHub preview card
📈 Sternhistorie
675674
2026-07-202026-07-29
📈 OmniVinci verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.

OmniVinci hat 675 Sterne auf GitHub. Es wurde 54-mal geforkt. OmniVinci ist hauptsächlich in Python geschrieben. Es wird seit 2025 aktiv entwickelt. OmniVinci ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

Was ist OmniVinci?

OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.

Ist OmniVinci Open Source?

OmniVinci ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.

Ist OmniVinci kostenlos?

Ja. OmniVinci ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht OmniVinci?

OmniVinci ist unter der Apache-2.0-Lizenz verfügbar.

In welcher Sprache ist OmniVinci geschrieben?

OmniVinci ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
OpenSourceAI badge — OmniVinci

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=nvlabs-omnivinci)](https://opensourceai.tech/project/nvlabs-omnivinci.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
cambrian-s
Cambrian-S: Auf dem Weg zu räumlichem Supersensing in Video
563 · computer-vision
teiltmultimodal-large-language-modelsvision-language-model
colette
Multimodales RAG, um lokal mit technischen Dokumenten jeglicher Art zu suchen und zu interagier…
301 · llm
teiltmultimodal-large-language-modelsvision-language-model
R1-VL
R1-VL: Lernen zu argumentieren mit multimodalen großen Sprachmodellen durch schrittweise gruppe…
352 · mllm
teiltmultimodal-large-language-modelsvision-language-model
SoundMind
Wir stellen den Audio Logical Reasoning (ALR) Datensatz vor, der aus 6.446 text-audio annotiert…
1.1k · audio-language-model
teiltaudio-language-model
Qwen-VL
Das offizielle Repository von Qwen-VL (通义千问-VL) Chat & vortrainiertem großem Sprachmodell, das…
6.7k · large-language-models
teiltvision-language-model
t2v_metrics
Bewertung von Text-zu-Bild-/Video-/3D-Modellen mit VQAScore
598 · generative-ai
teiltvision-language-model
Ovis
Eine neuartige Multimodale Large Language Model (MLLM) Architektur, die darauf ausgelegt ist, v…
1.5k · chatbot
teiltmultimodal-large-language-modelsvision-language-model
RoboFlamingo
Code für RoboFlamingo
438 · artificial-intelligence
teiltvision-language-model
Awesome-Medical-Large-Language-Models
Kuratiertes Papier zu großen Sprachmodellen im Gesundheitswesen und medizinischen Bereich
393 · large-language-models
teiltmultimodal-large-language-models
Ovis-U1
Ein einheitliches Modell, das multimodales Verständnis, Text-zu-Bild-Generierung und Bildbearbe…
450 · image-editing
teiltmultimodal-large-language-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.