Home Progetti LLaVA
LLaVA

LLaVA

di haotian-liu · GitHub

[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) costruito per capacità a livello GPT-4V e oltre.

Visualizza su GitHub
In parole semplici

Interagisci con contenuti visivi utilizzando capacità avanzate di AI per chat e istruzioni.

⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
🖥️ Auto-ospitato
Probabile
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
LLaVA — GitHub preview card
📈 Storia delle stelle
25.0k24.9k
2026-06-272026-07-29
📈 Segui LLaVA

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) costruito per capacità a livello GPT-4V e oltre.

LLaVA ha 25k stelle su GitHub. È stato forkato 2.8k volte. LLaVA è scritto principalmente in Python. È in sviluppo attivo dal 2023. LLaVA è disponibile con licenza Apache-2.0. I suoi temi principali sono: chatbot, chatgpt, foundation-models, gpt-4.

Frequently asked questions

Che cos'è LLaVA?

[NeurIPS'23 Oral] Visual Instruction Tuning (LLaVA) costruito per capacità a livello GPT-4V e oltre.

LLaVA è open source?

LLaVA è un progetto open source. È rilasciato con licenza Apache-2.0.

LLaVA è gratuito?

Sì. LLaVA è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è LLaVA?

LLaVA è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto LLaVA?

LLaVA è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — LLaVA

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=haotian-liu-llava)](https://opensourceai.tech/project/haotian-liu-llava.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Open-LLaVA-NeXT
Un'implementazione open-source per l'addestramento di LLaVA-NeXT.
439 · chatbot
condividevisual-language-learningmulti-modality
Olympus
[CVPR 2025 Highlight] Codice ufficiale per "Olympus: A Universal Task Router for Computer Visio…
428 · chatbot
condividemulti-modalityllava
RLHF-V
[CVPR'24] RLHF-V: Verso MLLM affidabili tramite allineamento comportamentale da feedback umano…
310 · chatbot
condividevisual-language-learningmulti-modality
Otter
🦦 Otter, un modello multi-modale basato su OpenFlamingo (versione open-source di Flamingo di De…
3.4k · artificial-inteligence
condividevisual-language-learningmulti-modality
NExT-GPT
Codice e modelli per l'articolo ICML 2024, NExT-GPT: Modello di Linguaggio Multimodale Any-to-A…
3.6k · chatgpt
condividevisual-language-learninginstruction-tuning
Groma
[ECCV2024] Modello di linguaggio multimodale ancorato con tokenizzazione visiva localizzata
585 · foundation-models
condividellama2vision-language-model
InternLM-XComposer
InternLM-XComposer2.5-OmniLive: Un sistema multimodale completo per interazioni video e audio i…
2.9k · chatgpt
condividevisual-language-learningmulti-modality
ViP-LLaVA
[CVPR2024] ViP-LLaVA: Rendere i modelli multimodali di grandi dimensioni in grado di comprender…
339 · chatbot
condividellavallama2
OPERA
[CVPR 2024 Highlight] OPERA: Alleviare l'allucinazione nei Modelli di Linguaggio di Grandi Dime…
412 · chatbot
condividevision-language-modelgpt-4
GPT-4-LLM
Istruzione di Tuning con GPT-4
4.3k · alpaca
condivideinstruction-tuninggpt-4

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.