Início Projetos OmniVinci
OmniVinci

OmniVinci

por NVlabs · GitHub

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

Ver no GitHub
Em palavras simples

Entenda e analise informações de imagens, áudio e texto juntos usando um modelo de IA multimodal.

⭐ Estrelas
🍴 Forks
🔥 Tendências
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
OmniVinci — GitHub preview card
📈 Histórico de estrelas
675674
2026-07-202026-07-29
📈 Acompanhe OmniVinci

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

OmniVinci tem 675 estrelas no GitHub. Foi bifurcado 54 vezes. OmniVinci é escrito principalmente em Python. Está em desenvolvimento ativo desde 2025. OmniVinci está disponível sob a licença Apache-2.0. Os seus principais temas são: audio-language-model, deep-learning, large-language-models, multimodal-large-language-models.

Frequently asked questions

O que é OmniVinci?

OmniVinci é um LLM omni-modal para compreensão conjunta de visão, áudio e linguagem.

OmniVinci é de código aberto?

OmniVinci é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

OmniVinci é gratuito?

Sim. OmniVinci é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está OmniVinci?

OmniVinci está disponível sob a licença Apache-2.0.

Em que linguagem OmniVinci está escrito?

OmniVinci é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — OmniVinci

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvlabs-omnivinci)](https://olud.ai/project/nvlabs-omnivinci.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
cambrian-s
Cambrian-S: Rumo à Super-sensação Espacial em Vídeo
563 · computer-vision
partilhamultimodal-large-language-modelsvision-language-model
colette
RAG multimodal para pesquisar e interagir localmente com documentos técnicos de qualquer tipo
301 · llm
partilhamultimodal-large-language-modelsvision-language-model
R1-VL
R1-VL: Aprendendo a Raciocinar com Modelos de Linguagem Grande Multimodal via Otimização de Pol…
352 · mllm
partilhamultimodal-large-language-modelsvision-language-model
SoundMind
Apresentamos o conjunto de dados Audio Logical Reasoning (ALR), consistindo em 6.446 amostras a…
1.1k · audio-language-model
partilhaaudio-language-model
Qwen-VL
O repositório oficial do Qwen-VL (通义千问-VL) chat & modelo de linguagem visual grande pré-treinad…
6.7k · large-language-models
partilhavision-language-model
t2v_metrics
Avaliação de modelos de texto-para-imagem/vídeo/3D com VQAScore
598 · generative-ai
partilhavision-language-model
Ovis
Uma nova arquitetura de Modelo de Linguagem Grande Multimodal (MLLM), projetada para alinhar es…
1.5k · chatbot
partilhamultimodal-large-language-modelsvision-language-model
RoboFlamingo
Código para RoboFlamingo
438 · artificial-intelligence
partilhavision-language-model
Awesome-Medical-Large-Language-Models
Artigos selecionados sobre Modelos de Linguagem Grande no setor de Saúde e Medicina
393 · large-language-models
partilhamultimodal-large-language-models
Ovis-U1
Um modelo unificado que integra perfeitamente compreensão multimodal, geração de texto para ima…
450 · image-editing
partilhamultimodal-large-language-models

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.