OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.
Comprende y analiza información de imágenes, audio y texto juntos utilizando un modelo de IA multimodal.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasOmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.
OmniVinci tiene 675 estrellas en GitHub. Se ha bifurcado 54 veces. OmniVinci está escrito principalmente en Python. Se desarrolla activamente desde 2025. OmniVinci está disponible bajo la licencia Apache-2.0. Sus temas principales son: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.
OmniVinci es un LLM omni-modal para la comprensión conjunta de visión, audio y lenguaje.
OmniVinci es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. OmniVinci es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
OmniVinci está disponible bajo la licencia Apache-2.0.
OmniVinci está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/nvlabs-omnivinci.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.