OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.
Verstehen und analysieren Sie Informationen aus Bildern, Audio und Text zusammen mit einem multimodalen KI-Modell.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarOmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.
OmniVinci hat 675 Sterne auf GitHub. Es wurde 54-mal geforkt. OmniVinci ist hauptsächlich in Python geschrieben. Es wird seit 2025 aktiv entwickelt. OmniVinci ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.
OmniVinci ist ein omni-modales LLM für das gemeinsame Verständnis von Vision, Audio und Sprache.
OmniVinci ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. OmniVinci ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
OmniVinci ist unter der Apache-2.0-Lizenz verfügbar.
OmniVinci ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/nvlabs-omnivinci.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.