Inicio Proyectos OmniVinci
OmniVinci
Python

OmniVinci

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

por NVlabs · GitHub
Estrellas
Ramas
Tendencias
Licencia
Creado
Último commit
Lenguaje
audio-language-modeldeep-learninglarge-language-modelsApache-2.0Python
Ver en GitHub
En palabras simples

Comprende y analiza información de imágenes, audio y texto juntos utilizando un modelo de IA multimodal.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
OmniVinci — GitHub preview card
📈 Historial de estrellas
677674
2026-07-202026-08-31
📈 Sigue OmniVinci

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

OmniVinci tiene 677 estrellas en GitHub. Se ha bifurcado 56 veces. OmniVinci está escrito principalmente en Python. Se desarrolla activamente desde 2025. OmniVinci está disponible bajo la licencia Apache-2.0. Sus temas principales son: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

¿Qué es OmniVinci?

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

¿OmniVinci es de código abierto?

OmniVinci es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿OmniVinci es gratis?

Sí. OmniVinci es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está OmniVinci?

OmniVinci está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito OmniVinci?

OmniVinci está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — OmniVinci

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Qwen-VL
El repositorio oficial de Qwen-VL (通义千问-VL) chat y modelo de lenguaje visual grande preentrenad…
6.7k · large-language-models
compartevision-language-model
t2v_metrics
Evaluando modelos de texto a imagen/video/3D con VQAScore
600 · generative-ai
compartevision-language-model
SoundMind
Presentamos el conjunto de datos de Razonamiento Lógico de Audio (ALR), que consta de 6,446 mue…
1.1k · audio-language-model
comparteaudio-language-model
Fun-ASR
Familia de modelos ASR basados en LLM de código abierto para chino, dialectos, acentos y habla…
1.4k · 31-languages
comparteaudio-language-model
RoboFlamingo
Código para RoboFlamingo
437 · artificial-intelligence
compartevision-language-model
Awesome-Medical-Large-Language-Models
Artículos seleccionados sobre Modelos de Lenguaje Grande en el ámbito de la Salud y Medicina
390 · large-language-models
compartemultimodal-large-language-models
Awesome-Multimodal-LLM-Autonomous-Driving
[WACV 2024 Survey Paper] Modelos de Lenguaje Multimodal para Conducción Autónoma
311 · autonomous-car
compartemultimodal-large-language-modelsvision-language-model
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementación oficial de Spatial-MLLM: Mejorando las Capacidades de M…
477 · aigc
compartemultimodal-large-language-models
MGM
Repositorio oficial para "Mini-Gemini: Mining the Potential of Multi-modality Vision Language M…
3.3k · generation
compartevision-language-model
Ovis-U1
Un modelo unificado que integra sin problemas comprensión multimodal, generación de texto a ima…
450 · image-editing
compartemultimodal-large-language-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.