Accueil Projets OmniVinci
OmniVinci

OmniVinci

par NVlabs · GitHub

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

Voir sur GitHub
En termes simples

Comprenez et analysez des informations provenant d'images, d'audio et de texte ensemble en utilisant un modèle IA multimodal.

⭐ Étoiles
🍴 Forks
🔥 Tendances
📜 Licence
Utilisation commerciale autorisée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
💻 Langue
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
OmniVinci — GitHub preview card
📈 Historique des étoiles
675674
2026-07-202026-07-29
📈 Suivez OmniVinci

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

OmniVinci compte 675 étoiles sur GitHub. Il a été forké 54 fois. OmniVinci est écrit principalement en Python. Il est développé activement depuis 2025. OmniVinci est disponible sous licence Apache-2.0. Ses principaux thèmes sont : audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

Qu'est-ce que OmniVinci ?

OmniVinci est un LLM omni-modal pour la compréhension conjointe de la vision, de l'audio et du langage.

OmniVinci est-il open source ?

OmniVinci est un projet open source. Il est distribué sous licence Apache-2.0.

OmniVinci est-il gratuit ?

Oui. OmniVinci est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est OmniVinci ?

OmniVinci est disponible sous licence Apache-2.0.

Dans quel langage OmniVinci est-il écrit ?

OmniVinci est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
OpenSourceAI badge — OmniVinci

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=nvlabs-omnivinci)](https://opensourceai.tech/project/nvlabs-omnivinci.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
cambrian-s
Cambrian-S : Vers une supersensibilité spatiale dans la vidéo
563 · computer-vision
partagemultimodal-large-language-modelsvision-language-model
colette
RAG multimodal pour rechercher et interagir localement avec des documents techniques de tout ty…
301 · llm
partagemultimodal-large-language-modelsvision-language-model
R1-VL
R1-VL : Apprendre à raisonner avec des modèles de langage multimodaux via l'optimisation de pol…
352 · mllm
partagemultimodal-large-language-modelsvision-language-model
SoundMind
Nous introduisons le jeu de données Audio Logical Reasoning (ALR), composé de 6 446 échantillon…
1.1k · audio-language-model
partageaudio-language-model
Qwen-VL
Le dépôt officiel de Qwen-VL (通义千问-VL) chat & modèle de langage visuel pré-entraîné proposé par…
6.7k · large-language-models
partagevision-language-model
t2v_metrics
Évaluation des modèles texte-image/vidéo/3D avec VQAScore
598 · generative-ai
partagevision-language-model
Ovis
Une nouvelle architecture de Modèle de Langage Multimodal (MLLM), conçue pour aligner structure…
1.5k · chatbot
partagemultimodal-large-language-modelsvision-language-model
RoboFlamingo
Code pour RoboFlamingo
438 · artificial-intelligence
partagevision-language-model
Awesome-Medical-Large-Language-Models
Articles sélectionnés sur les grands modèles de langage dans le domaine de la santé et médical
393 · large-language-models
partagemultimodal-large-language-models
Ovis-U1
Un modèle unifié qui intègre parfaitement la compréhension multimodale, la génération de texte…
450 · image-editing
partagemultimodal-large-language-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.