Inicio Proyectos OmniVinci
OmniVinci

OmniVinci

por NVlabs · GitHub

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

Ver en GitHub
En palabras simples

Comprende y analiza información de imágenes, audio y texto juntos utilizando un modelo de IA multimodal.

⭐ Estrellas
🍴 Ramas
🔥 Tendencias
📜 Licencia
Uso comercial permitido
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
OmniVinci — GitHub preview card
📈 Historial de estrellas
675674
2026-07-202026-07-29
📈 Sigue OmniVinci

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

OmniVinci tiene 675 estrellas en GitHub. Se ha bifurcado 54 veces. OmniVinci está escrito principalmente en Python. Se desarrolla activamente desde 2025. OmniVinci está disponible bajo la licencia Apache-2.0. Sus temas principales son: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

¿Qué es OmniVinci?

OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.

¿OmniVinci es de código abierto?

OmniVinci es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿OmniVinci es gratis?

Sí. OmniVinci es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está OmniVinci?

OmniVinci está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito OmniVinci?

OmniVinci está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — OmniVinci

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
cambrian-s
Cambrian-S: Hacia la Supersensación Espacial en Video
563 · computer-vision
compartemultimodal-large-language-modelsvision-language-model
colette
RAG multimodal para buscar e interactuar localmente con documentos técnicos de cualquier tipo
301 · llm
compartemultimodal-large-language-modelsvision-language-model
R1-VL
R1-VL: Aprendiendo a Razonar con Modelos de Lenguaje Grande Multimodal a través de Optimización…
352 · mllm
compartemultimodal-large-language-modelsvision-language-model
SoundMind
Presentamos el conjunto de datos de Razonamiento Lógico de Audio (ALR), que consta de 6,446 mue…
1.1k · audio-language-model
comparteaudio-language-model
Qwen-VL
El repositorio oficial de Qwen-VL (通义千问-VL) chat y modelo de lenguaje visual grande preentrenad…
6.7k · large-language-models
compartevision-language-model
t2v_metrics
Evaluando modelos de texto a imagen/video/3D con VQAScore
598 · generative-ai
compartevision-language-model
Ovis
Una nueva arquitectura de Modelo de Lenguaje Multimodal Grande (MLLM), diseñada para alinear es…
1.5k · chatbot
compartemultimodal-large-language-modelsvision-language-model
RoboFlamingo
Código para RoboFlamingo
438 · artificial-intelligence
compartevision-language-model
Awesome-Medical-Large-Language-Models
Artículos seleccionados sobre Modelos de Lenguaje Grande en el ámbito de la Salud y Medicina
393 · large-language-models
compartemultimodal-large-language-models
Ovis-U1
Un modelo unificado que integra sin problemas comprensión multimodal, generación de texto a ima…
450 · image-editing
compartemultimodal-large-language-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.