Home Progetti Chat-UniVi
Chat-UniVi

Chat-UniVi

di PKU-YuanGroup · GitHub

[CVPR 2024 Highlight🔥] Chat-UniVi: Rappresentazione Visiva Unificata Potenzia i Modelli di Linguaggio di Grandi Dimensioni con Comprensione di Immagini e Video

Visualizza su GitHub
In parole semplici

Utilizza una rappresentazione visiva unificata per aiutare i modelli di linguaggio di grandi dimensioni a comprendere meglio immagini e video.

⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Chat-UniVi — GitHub preview card
📈 Storia delle stelle
944943
2026-07-202026-07-29
📈 Segui Chat-UniVi

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

[CVPR 2024 Highlight🔥] Chat-UniVi: Rappresentazione Visiva Unificata Potenzia i Modelli di Linguaggio di Grandi Dimensioni con Comprensione di Immagini e Video

Chat-UniVi ha 943 stelle su GitHub. È stato forkato 48 volte. Chat-UniVi è scritto principalmente in Python. È in sviluppo attivo dal 2023. Chat-UniVi è disponibile con licenza Apache-2.0. I suoi temi principali sono: image-understanding, large-language-models, video-understanding, vision-language-model.

Frequently asked questions

Che cos'è Chat-UniVi?

[CVPR 2024 Highlight🔥] Chat-UniVi: Rappresentazione Visiva Unificata Potenzia i Modelli di Linguaggio di Grandi Dimensioni con Comprensione di Immagini e Video

Chat-UniVi è open source?

Chat-UniVi è un progetto open source. È rilasciato con licenza Apache-2.0.

Chat-UniVi è gratuito?

Sì. Chat-UniVi è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Chat-UniVi?

Chat-UniVi è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto Chat-UniVi?

Chat-UniVi è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — Chat-UniVi

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=pku-yuangroup-chat-univi)](https://opensourceai.tech/project/pku-yuangroup-chat-univi.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Lance
Un modello multimodale nativo unificato a 3B parametri attivi per la comprensione, generazione…
1.3k · image-editing
condivideimage-understandingvideo-understanding
Qwen-VL
Il repository ufficiale di Qwen-VL (通义千问-VL) chat e modello di linguaggio visivo pre-addestrato…
6.7k · large-language-models
condividevision-language-model
t2v_metrics
Valutazione di modelli testo-immagine/video/3D con VQAScore
598 · generative-ai
condividevision-language-model
vllm-mlx
Server compatibile con OpenAI e Anthropic per Apple Silicon. Esegui LLM e modelli linguaggio-vi…
1.5k · anthropic
condivideimage-understandingvideo-understanding
RoboFlamingo
Codice per RoboFlamingo
438 · artificial-intelligence
condividevision-language-model
video-understanding-dataset
Una collezione di recenti dataset di comprensione video, in costruzione!
469 · action-recognition
condividevideo-understanding
InternVLA-M1
InternVLA-M1: Un framework spazialmente guidato Vision-Language-Action per politiche di robot g…
419 · robotics
condividevision-language-model
MGM
Repo ufficiale per "Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models"
3.3k · generation
condividevision-language-model
Senna
Collegare i Modelli di Visione-Linguaggio di Grandi Dimensioni e la Guida Autonoma End-to-End
550 · autonomous-driving
condividevision-language-model
lmms-eval
Toolkit di valutazione multimodale One-for-All per compiti di testo, immagine, video e audio
4.3k · agi
condividevideo-understandingvision-language-model

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.