Início Projetos Groma
Groma
Python

Groma

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

por FoundationVision · GitHub
Estrelas
Forks
Licença
Criado
Último commit
Linguagem
Provável
Auto-hospedável
foundation-modelsgroundinglarge-language-modelsApache-2.0PythonAuto-hospedável
Ver no GitHub
Em palavras simples

Interaja com um grande modelo de linguagem que entende o contexto visual e pode gerar respostas detalhadas com base em imagens.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
Groma — GitHub preview card
📈 Histórico de estrelas
586585
2026-07-202026-08-31
📈 Acompanhe Groma

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

Groma tem 586 estrelas no GitHub. Foi bifurcado 44 vezes. Groma é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. Groma está disponível sob a licença Apache-2.0. Os seus principais temas são: foundation-models, grounding, large-language-models, llama.

Frequently asked questions

O que é Groma?

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

Groma é de código aberto?

Groma é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

Groma é gratuito?

Sim. Groma é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está Groma?

Groma está disponível sob a licença Apache-2.0.

Em que linguagem Groma está escrito?

Groma é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — Groma

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=foundationvision-groma)](https://olud.ai/project/foundationvision-groma.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Thinking-with-Visual-Primitives
Archived snapshot of Thinking-with-Visual-Primitives
276 · deepseek
partilhagroundingvision-language-model
NExT-GPT
Código e modelos para o artigo ICML 2024, NExT-GPT: Modelo de Linguagem Grande Multimodal de Qu…
3.6k · chatgpt
partilhamllmfoundation-models
Awesome-Reasoning-Foundation-Models
✨✨Últimos Artigos e Benchmarks em Raciocínio com Modelos Fundamentais
656 · foundation-models
partilhafoundation-modelsmultimodal
Awesome-Multimodal-LLM-Autonomous-Driving
[Artigo de Pesquisa WACV 2024] Modelos de Linguagem Multimodais para Condução Autônoma
311 · autonomous-car
partilhavision-language-modelfoundation-models
mPLUG-DocOwl
mPLUG-DocOwl: Modelo de Linguagem Grande Multimodal Modularizado para Compreensão de Documentos
2.4k · chart-understanding
partilhamllmmultimodal
lag-llama
Lag-Llama: Rumo a Modelos Fundamentais para Previsão Probabilística de Séries Temporais
1.6k · forecasting
partilhafoundation-modelsllama
VoxPoser
VoxPoser: Mapas de Valor 3D Componíveis para Manipulação Robótica com Modelos de Linguagem
833 · embodied-ai
partilhavision-language-modelfoundation-models
ONE-PEACE
Um modelo de representação geral através de modalidades de visão, áudio e linguagem. Artigo: ON…
1.1k · audio-language
partilhafoundation-modelsmultimodal
tokenize-anything
[ECCV 2024] Tokenize Anything via Prompting
601 · foundation-models
partilhafoundation-modelsmultimodal
mllm
LLM Multimodal Rápido em Dispositivos Móveis
1.6k · ai
partilhallamamultimodal

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.