Início Projetos Groma
Groma

Groma

por FoundationVision · GitHub

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

Ver no GitHub
⭐ Estrelas
🍴 Forks
📜 Licença
Uso comercial permitido
📅 Criado
🔄 Último commit
🏷️ Categoria
💻 Linguagem
🖥️ Auto-hospedável
Provável
Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
Groma — GitHub preview card
📈 Histórico de estrelas
586585
2026-07-202026-07-29
📈 Acompanhe Groma

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

Groma tem 585 estrelas no GitHub. Foi bifurcado 44 vezes. Groma é escrito principalmente em Python. Está em desenvolvimento ativo desde 2024. Groma está disponível sob a licença Apache-2.0. Os seus principais temas são: foundation-models, grounding, large-language-models, llama.

Frequently asked questions

O que é Groma?

[ECCV2024] Modelo de Linguagem Grande Multimodal Fundamentado com Tokenização Visual Localizada

Groma é de código aberto?

Groma é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

Groma é gratuito?

Sim. Groma é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está Groma?

Groma está disponível sob a licença Apache-2.0.

Em que linguagem Groma está escrito?

Groma é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
OpenSourceAI badge — Groma

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=foundationvision-groma)](https://opensourceai.tech/project/foundationvision-groma.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Thinking-with-Visual-Primitives
Instantâneo arquivado de Thinking-with-Visual-Primitives
273 · deepseek
partilhagroundingvision-language-model
LLaVA
[NeurIPS'23 Oral] Ajuste de Instrução Visual (LLaVA) construído para capacidades de nível GPT-4…
25k · chatbot
partilhallama2vision-language-model
NExT-GPT
Código e modelos para o artigo ICML 2024, NExT-GPT: Modelo de Linguagem Grande Multimodal de Qu…
3.6k · chatgpt
partilhamllmfoundation-models
OPERA
[CVPR 2024 Destaque] OPERA: Aliviando Alucinações em Modelos de Linguagem de Grande Escala Mult…
412 · chatbot
partilhavision-language-modelllama
Awesome-Multimodal-LLM-Autonomous-Driving
[WACV 2024 Survey Paper] Modelos de Linguagem Multimodais para Direção Autônoma
313 · autonomous-car
partilhavision-language-modelfoundation-models
R1-VL
R1-VL: Aprendendo a Raciocinar com Modelos de Linguagem Grande Multimodal via Otimização de Pol…
352 · mllm
partilhamllmvision-language-model
Olympus
[Destaque CVPR 2025] Código oficial para "Olympus: Um Roteador de Tarefas Universal para Tarefa…
428 · chatbot
partilhavision-language-modelfoundation-models
tokenize-anything
[ECCV 2024] Tokenize Anything via Prompting
601 · foundation-models
partilhafoundation-modelsmultimodal
VoxPoser
VoxPoser: Mapas de Valor 3D Componíveis para Manipulação Robótica com Modelos de Linguagem
826 · embodied-ai
partilhavision-language-modelfoundation-models
mllm
LLM Multimodal Rápido em Dispositivos Móveis
1.6k · ai
partilhallamamultimodal

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.