[CVPR2024] ViP-LLaVA: Große multimodale Modelle dazu bringen, beliebige visuelle Eingabeaufforderungen zu verstehen
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbar[CVPR2024] ViP-LLaVA: Große multimodale Modelle dazu bringen, beliebige visuelle Eingabeaufforderungen zu verstehen
ViP-LLaVA hat 339 Sterne auf GitHub. Es wurde 21-mal geforkt. ViP-LLaVA ist hauptsächlich in Python geschrieben. Es wird seit 2023 aktiv entwickelt. ViP-LLaVA ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: chatbot, clip, cvpr2024, foundation-models.
[CVPR2024] ViP-LLaVA: Große multimodale Modelle dazu bringen, beliebige visuelle Eingabeaufforderungen zu verstehen
ViP-LLaVA ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. ViP-LLaVA ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
ViP-LLaVA ist unter der Apache-2.0-Lizenz verfügbar.
ViP-LLaVA ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://opensourceai.tech/project/wisconsinaivision-vip-llava.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.