[Démonstration EMNLP 2023] Video-LLaMA : Un modèle de langage audio-visuel ajusté par instruction pour la compréhension vidéo
Utilisez un modèle de langage pour comprendre et analyser le contenu vidéo et audio.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout moment[Démonstration EMNLP 2023] Video-LLaMA : Un modèle de langage audio-visuel ajusté par instruction pour la compréhension vidéo
Video-LLaMA compte 3.1k étoiles sur GitHub. Il a été forké 287 fois. Video-LLaMA est écrit principalement en Python. Il est développé activement depuis 2023. Video-LLaMA est disponible sous licence BSD-3-Clause. Ses principaux thèmes sont : blip2, cross-modal-pretraining, large-language-models, llama.
[Démonstration EMNLP 2023] Video-LLaMA : Un modèle de langage audio-visuel ajusté par instruction pour la compréhension vidéo
Video-LLaMA est un projet open source. Il est distribué sous licence BSD-3-Clause.
Oui. Video-LLaMA est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
Video-LLaMA est disponible sous licence BSD-3-Clause.
Video-LLaMA est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/damo-nlp-sg-video-llama.html)