Home Progetti OmniVinci
OmniVinci
Python

OmniVinci

OmniVinci è un LLM omni-modale per la comprensione congiunta di visione, audio e linguaggio.

di NVlabs · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
audio-language-modeldeep-learninglarge-language-modelsApache-2.0Python
Visualizza su GitHub
In parole semplici

Comprendi e analizza informazioni da immagini, audio e testo insieme utilizzando un modello di IA multi-modale.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
OmniVinci — GitHub preview card
📈 Storia delle stelle
677674
2026-07-202026-08-31
📈 Segui OmniVinci

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

OmniVinci è un LLM omni-modale per la comprensione congiunta di visione, audio e linguaggio.

OmniVinci ha 677 stelle su GitHub. È stato forkato 56 volte. OmniVinci è scritto principalmente in Python. È in sviluppo attivo dal 2025. OmniVinci è disponibile con licenza Apache-2.0. I suoi temi principali sono: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

Che cos'è OmniVinci?

OmniVinci è un LLM omni-modale per la comprensione congiunta di visione, audio e linguaggio.

OmniVinci è open source?

OmniVinci è un progetto open source. È rilasciato con licenza Apache-2.0.

OmniVinci è gratuito?

Sì. OmniVinci è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è OmniVinci?

OmniVinci è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto OmniVinci?

OmniVinci è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — OmniVinci

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Qwen-VL
Il repository ufficiale di Qwen-VL (通义千问-VL) chat e modello di linguaggio visivo pre-addestrato…
6.7k · large-language-models
condividevision-language-model
t2v_metrics
Valutazione di modelli testo-immagine/video/3D con VQAScore
600 · generative-ai
condividevision-language-model
SoundMind
Introduciamo il dataset Audio Logical Reasoning (ALR), composto da 6.446 campioni annotati test…
1.1k · audio-language-model
condivideaudio-language-model
Fun-ASR
Famiglia di modelli ASR basati su LLM open-source per cinese, dialetto, accento e parlato multi…
1.4k · 31-languages
condivideaudio-language-model
RoboFlamingo
Codice per RoboFlamingo
437 · artificial-intelligence
condividevision-language-model
Awesome-Medical-Large-Language-Models
Articoli curati sui modelli di linguaggio di grandi dimensioni nel settore sanitario e medico
390 · large-language-models
condividemultimodal-large-language-models
Awesome-Multimodal-LLM-Autonomous-Driving
[WACV 2024 Survey Paper] Modelli di linguaggio multimodali per la guida autonoma
311 · autonomous-car
condividemultimodal-large-language-modelsvision-language-model
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementazione ufficiale di Spatial-MLLM: Potenziamento delle Capacit…
477 · aigc
condividemultimodal-large-language-models
MGM
Repo ufficiale per "Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models"
3.3k · generation
condividevision-language-model
Ovis-U1
Un modello unificato che integra senza soluzione di continuità comprensione multimodale, genera…
450 · image-editing
condividemultimodal-large-language-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.