[EMNLP 2023 Demo] Video-LLaMA: Ein anweisungsoptimiertes audio-visuelles Sprachmodell für das Verständnis von Videos
Verwenden Sie ein Sprachmodell, um Video- und Audioinhalte zu verstehen und zu analysieren.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbar[EMNLP 2023 Demo] Video-LLaMA: Ein anweisungsoptimiertes audio-visuelles Sprachmodell für das Verständnis von Videos
Video-LLaMA hat 3.1k Sterne auf GitHub. Es wurde 287-mal geforkt. Video-LLaMA ist hauptsächlich in Python geschrieben. Es wird seit 2023 aktiv entwickelt. Video-LLaMA ist unter der BSD-3-Clause-Lizenz verfügbar. Die Hauptthemen sind: blip2, cross-modal-pretraining, large-language-models, llama.
[EMNLP 2023 Demo] Video-LLaMA: Ein anweisungsoptimiertes audio-visuelles Sprachmodell für das Verständnis von Videos
Video-LLaMA ist ein Open-Source-Projekt. Es wird unter der BSD-3-Clause-Lizenz veröffentlicht.
Ja. Video-LLaMA ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
Video-LLaMA ist unter der BSD-3-Clause-Lizenz verfügbar.
Video-LLaMA ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/damo-nlp-sg-video-llama.html)