Início Projetos OmniVinci
OmniVinci
Python

OmniVinci

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

por NVlabs · GitHub
Estrelas
Forks
Tendências
Licença
Criado
Último commit
Linguagem
audio-language-modeldeep-learninglarge-language-modelsApache-2.0Python
Ver no GitHub
Em palavras simples

Entenda e analise informações de imagens, áudio e texto juntos usando um modelo de IA multimodal.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
OmniVinci — GitHub preview card
📈 Histórico de estrelas
677674
2026-07-202026-08-31
📈 Acompanhe OmniVinci

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

OmniVinci tem 677 estrelas no GitHub. Foi bifurcado 56 vezes. OmniVinci é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. OmniVinci está disponível sob a licença Apache-2.0. Os seus principais temas são: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

O que é OmniVinci?

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

OmniVinci é de código aberto?

OmniVinci é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

OmniVinci é gratuito?

Sim. OmniVinci é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está OmniVinci?

OmniVinci está disponível sob a licença Apache-2.0.

Em que linguagem OmniVinci está escrito?

OmniVinci é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — OmniVinci

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Qwen-VL
O repositório oficial do Qwen-VL (通义千问-VL) chat & modelo de linguagem visual grande pré-treinad…
6.7k · large-language-models
partilhavision-language-model
t2v_metrics
Avaliação de modelos de texto-para-imagem/vídeo/3D com VQAScore
600 · generative-ai
partilhavision-language-model
SoundMind
Apresentamos o conjunto de dados Audio Logical Reasoning (ALR), consistindo em 6.446 amostras a…
1.1k · audio-language-model
partilhaaudio-language-model
Fun-ASR
Família de modelos ASR baseados em LLM de código aberto para chinês, dialeto, sotaque e fala mu…
1.4k · 31-languages
partilhaaudio-language-model
RoboFlamingo
Código para RoboFlamingo
437 · artificial-intelligence
partilhavision-language-model
Awesome-Medical-Large-Language-Models
Artigos selecionados sobre Modelos de Linguagem Grande no setor de Saúde e Medicina
390 · large-language-models
partilhamultimodal-large-language-models
Awesome-Multimodal-LLM-Autonomous-Driving
[Artigo de Pesquisa WACV 2024] Modelos de Linguagem Multimodais para Condução Autônoma
311 · autonomous-car
partilhamultimodal-large-language-modelsvision-language-model
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementação oficial do Spatial-MLLM: Aumentando as Capacidades de ML…
477 · aigc
partilhamultimodal-large-language-models
MGM
Repositório oficial para "Mini-Gemini: Mining the Potential of Multi-modality Vision Language M…
3.3k · generation
partilhavision-language-model
Ovis-U1
Um modelo unificado que integra perfeitamente compreensão multimodal, geração de texto para ima…
450 · image-editing
partilhamultimodal-large-language-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.