Home Progetti t2v_metrics
t2v_metrics
Python

t2v_metrics

Valutazione di modelli testo-immagine/video/3D con VQAScore

di linzhiqiu · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Categoria
Lingua
generative-aivision-language-modelApache-2.0Python
Visualizza su GitHub
In parole semplici

Valuta automaticamente la qualità di immagini da testo, video o modelli 3D con un semplice comando.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
t2v_metrics — GitHub preview card
📈 Storia delle stelle
600595
2026-07-202026-08-31
📈 Segui t2v_metrics

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Valutazione di modelli testo-immagine/video/3D con VQAScore

t2v_metrics ha 600 stelle su GitHub. È stato forkato 76 volte. t2v_metrics è scritto principalmente in Python. È in sviluppo attivo dal 2023. t2v_metrics è disponibile con licenza Apache-2.0. I suoi temi principali sono: generative-ai, vision-language-model.

Frequently asked questions

Che cos'è t2v_metrics?

Valutazione di modelli testo-immagine/video/3D con VQAScore

t2v_metrics è open source?

t2v_metrics è un progetto open source. È rilasciato con licenza Apache-2.0.

t2v_metrics è gratuito?

Sì. t2v_metrics è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è t2v_metrics?

t2v_metrics è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto t2v_metrics?

t2v_metrics è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — t2v_metrics

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=linzhiqiu-t2v-metrics)](https://olud.ai/project/linzhiqiu-t2v-metrics.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Qwen-VL
Il repository ufficiale di Qwen-VL (通义千问-VL) chat e modello di linguaggio visivo pre-addestrato…
6.7k · large-language-models
condividevision-language-model
RoboFlamingo
Codice per RoboFlamingo
437 · artificial-intelligence
condividevision-language-model
MGM
Repo ufficiale per "Mini-Gemini: Mining the Potential of Multi-modality Vision Language Models"
3.3k · generation
condividevision-language-model
Senna
Collegare i Modelli di Visione-Linguaggio di Grandi Dimensioni e la Guida Autonoma End-to-End
551 · autonomous-driving
condividevision-language-model
InternVLA-M1
InternVLA-M1: Un framework spazialmente guidato Vision-Language-Action per politiche di robot g…
418 · robotics
condividevision-language-model
awesome-knowledge-driven-AD
Un elenco curato di fantastici strumenti di guida autonoma basati sulla conoscenza (costantemen…
499 · autonomous-driving
condividevision-language-model
Awesome-LLM4AD
Un elenco curato di risorse fantastiche LLM/VLM/VLA/World Model per la Guida Autonoma (LLM4AD)…
1.9k · large-language-models
condividevision-language-model
Chat-UniVi
[CVPR 2024 Highlight🔥] Chat-UniVi: Rappresentazione Visiva Unificata Potenzia i Modelli di Ling…
941 · image-understanding
condividevision-language-model
OmniVinci
OmniVinci è un LLM omni-modale per la comprensione congiunta di visione, audio e linguaggio.
677 · audio-language-model
condividevision-language-model
Thinking-with-Visual-Primitives
Archived snapshot of Thinking-with-Visual-Primitives
276 · deepseek
condividevision-language-model

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.