Accueil Projets OmniVinci
OmniVinci
Python

OmniVinci

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

par NVlabs · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
audio-language-modeldeep-learninglarge-language-modelsApache-2.0Python
Voir sur GitHub
En termes simples

Comprendre et analyser des informations provenant d'images, d'audio et de texte ensemble à l'aide d'un modèle IA multi-modal.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
OmniVinci — GitHub preview card
📈 Historique des étoiles
677674
2026-07-202026-08-31
📈 Suivez OmniVinci

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

OmniVinci compte 677 étoiles sur GitHub. Il a été forké 56 fois. OmniVinci est écrit principalement en Python. Il est développé activement depuis 2025. OmniVinci est disponible sous licence Apache-2.0. Ses principaux thèmes sont : audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

Qu'est-ce que OmniVinci ?

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

OmniVinci est-il open source ?

OmniVinci est un projet open source. Il est distribué sous licence Apache-2.0.

OmniVinci est-il gratuit ?

Oui. OmniVinci est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est OmniVinci ?

OmniVinci est disponible sous licence Apache-2.0.

Dans quel langage OmniVinci est-il écrit ?

OmniVinci est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — OmniVinci

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Qwen-VL
Le dépôt officiel de Qwen-VL (通义千问-VL) chat & modèle de langage visuel pré-entraîné proposé par…
6.7k · large-language-models
partagevision-language-model
t2v_metrics
Évaluation des modèles texte-image/vidéo/3D avec VQAScore
600 · generative-ai
partagevision-language-model
SoundMind
Nous introduisons le jeu de données Audio Logical Reasoning (ALR), composé de 6 446 échantillon…
1.1k · audio-language-model
partageaudio-language-model
Fun-ASR
Famille de modèles ASR basés sur LLM open source pour le chinois, les dialectes, les accents et…
1.4k · 31-languages
partageaudio-language-model
RoboFlamingo
Code pour RoboFlamingo
437 · artificial-intelligence
partagevision-language-model
Awesome-Medical-Large-Language-Models
Articles sélectionnés sur les grands modèles de langage dans le domaine de la santé et médical
390 · large-language-models
partagemultimodal-large-language-models
Awesome-Multimodal-LLM-Autonomous-Driving
[WACV 2024 Article de synthèse] Modèles de langage multimodaux pour la conduite autonome
311 · autonomous-car
partagemultimodal-large-language-modelsvision-language-model
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implémentation officielle de Spatial-MLLM : Amélioration des Capacités…
477 · aigc
partagemultimodal-large-language-models
MGM
Dépôt officiel pour "Mini-Gemini : Exploiter le potentiel des modèles de langage vision multi-m…
3.3k · generation
partagevision-language-model
Ovis-U1
Un modèle unifié qui intègre parfaitement la compréhension multimodale, la génération de texte…
450 · image-editing
partagemultimodal-large-language-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.