[EMNLP 2023 Demo] Video-LLaMA: Un Modello Linguistico Audio-Visivo Ottimizzato per la Comprensione dei Video
Utilizza un modello di linguaggio per comprendere e analizzare contenuti video e audio.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi[EMNLP 2023 Demo] Video-LLaMA: Un Modello Linguistico Audio-Visivo Ottimizzato per la Comprensione dei Video
Video-LLaMA ha 3.1k stelle su GitHub. È stato forkato 287 volte. Video-LLaMA è scritto principalmente in Python. È in sviluppo attivo dal 2023. Video-LLaMA è disponibile con licenza BSD-3-Clause. I suoi temi principali sono: blip2, cross-modal-pretraining, large-language-models, llama.
[EMNLP 2023 Demo] Video-LLaMA: Un Modello Linguistico Audio-Visivo Ottimizzato per la Comprensione dei Video
Video-LLaMA è un progetto open source. È rilasciato con licenza BSD-3-Clause.
Sì. Video-LLaMA è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
Video-LLaMA è disponibile con licenza BSD-3-Clause.
Video-LLaMA è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/damo-nlp-sg-video-llama.html)