Home Progetti Ovis
Ovis
Python

Ovis

Un'architettura innovativa di Modello di Linguaggio Multimodale (MLLM), progettata per allineare strutturalmente le embedding visive e testuali.

di ATH-MaaS · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Categoria
Lingua
Probabile
Auto-ospitato
chatbotllama3multimodalApache-2.0PythonAuto-ospitato
Visualizza su GitHub
In parole semplici

Esplora e sviluppa un modello che comprende sia immagini che testo insieme per applicazioni AI avanzate.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Ovis — GitHub preview card
📈 Storia delle stelle
1.47k1.46k
2026-07-202026-08-31
📈 Segui Ovis

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Un'architettura innovativa di Modello di Linguaggio Multimodale (MLLM), progettata per allineare strutturalmente le embedding visive e testuali.

Ovis ha 1.5k stelle su GitHub. È stato forkato 84 volte. Ovis è scritto principalmente in Python. È in sviluppo attivo dal 2024. Ovis è disponibile con licenza Apache-2.0. I suoi temi principali sono: chatbot, llama3, multimodal, multimodal-large-language-models.

Frequently asked questions

Che cos'è Ovis?

Un'architettura innovativa di Modello di Linguaggio Multimodale (MLLM), progettata per allineare strutturalmente le embedding visive e testuali.

Ovis è open source?

Ovis è un progetto open source. È rilasciato con licenza Apache-2.0.

Ovis è gratuito?

Sì. Ovis è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Ovis?

Ovis è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto Ovis?

Ovis è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — Ovis

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=ath-maas-ovis)](https://olud.ai/project/ath-maas-ovis.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementazione ufficiale di Spatial-MLLM: Potenziamento delle Capacit…
477 · aigc
condividemultimodal-large-language-modelsmultimodal
VisionReasoner
[ICLR 2026] VisionReasoner: Percezione Visiva Integrata con Ragionamento Unificato tramite Appr…
348 · counting-objects
condividemultimodal-large-language-modelsmultimodal
EVF-SAM
Codice ufficiale di "EVF-SAM: Fusione Precoce Visione-Linguaggio per il Modello Segmenta Qualsi…
505 · multimodal
condividemultimodal-large-language-modelsmultimodal
Awesome-Medical-Large-Language-Models
Articoli curati sui modelli di linguaggio di grandi dimensioni nel settore sanitario e medico
390 · large-language-models
condividemultimodal-large-language-models
Ovis-U1
Un modello unificato che integra senza soluzione di continuità comprensione multimodale, genera…
450 · image-editing
condividemultimodal-large-language-models
PicoMLXServer
Il modo più semplice per eseguire i LLM basati su MLX più veloci localmente
327 · ai
condividellama3
cambrian-s
Cambrian-S: Verso il Supersensing Spaziale nel Video
560 · computer-vision
condividemultimodal-large-language-models
NEO
NEO Series: Modelli di visione-linguaggio nativi dai principi fondamentali
888 · agi
condividemultimodal-large-language-modelsmultimodal
visualwebarena
VisualWebArena è un benchmark per agenti multimodali.
482 · agents
condividemultimodal
star-vector
StarVector è un modello di base per la generazione di SVG che trasforma la vettorizzazione in u…
4.6k · llm
condividemultimodal-large-language-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.