[CVPR2024] ViP-LLaVA: Rendere i modelli multimodali di grandi dimensioni in grado di comprendere prompt visivi arbitrari
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoi[CVPR2024] ViP-LLaVA: Rendere i modelli multimodali di grandi dimensioni in grado di comprendere prompt visivi arbitrari
ViP-LLaVA ha 339 stelle su GitHub. È stato forkato 21 volte. ViP-LLaVA è scritto principalmente in Python. È in sviluppo attivo dal 2023. ViP-LLaVA è disponibile con licenza Apache-2.0. I suoi temi principali sono: chatbot, clip, cvpr2024, foundation-models.
[CVPR2024] ViP-LLaVA: Rendere i modelli multimodali di grandi dimensioni in grado di comprendere prompt visivi arbitrari
ViP-LLaVA è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. ViP-LLaVA è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
ViP-LLaVA è disponibile con licenza Apache-2.0.
ViP-LLaVA è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://opensourceai.tech/project/wisconsinaivision-vip-llava.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.