Inicio Proyectos Ovis
Ovis
Python

Ovis

Una nueva arquitectura de Modelo de Lenguaje Multimodal Grande (MLLM), diseñada para alinear estructuralmente incrustaciones visuales y textuales.

por ATH-MaaS · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Categoría
Lenguaje
Probable
Autoalojable
chatbotllama3multimodalApache-2.0PythonAutoalojable
Ver en GitHub
En palabras simples

Explora y desarrolla un modelo que entienda tanto imágenes como texto juntos para aplicaciones avanzadas de IA.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Ovis — GitHub preview card
📈 Historial de estrellas
1.47k1.46k
2026-07-202026-08-31
📈 Sigue Ovis

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Una nueva arquitectura de Modelo de Lenguaje Multimodal Grande (MLLM), diseñada para alinear estructuralmente incrustaciones visuales y textuales.

Ovis tiene 1.5k estrellas en GitHub. Se ha bifurcado 84 veces. Ovis está escrito principalmente en Python. Se desarrolla activamente desde 2024. Ovis está disponible bajo la licencia Apache-2.0. Sus temas principales son: chatbot, llama3, multimodal, multimodal-large-language-models.

Frequently asked questions

¿Qué es Ovis?

Una nueva arquitectura de Modelo de Lenguaje Multimodal Grande (MLLM), diseñada para alinear estructuralmente incrustaciones visuales y textuales.

¿Ovis es de código abierto?

Ovis es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿Ovis es gratis?

Sí. Ovis es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está Ovis?

Ovis está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito Ovis?

Ovis está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Ovis

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=ath-maas-ovis)](https://olud.ai/project/ath-maas-ovis.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Spatial-MLLM
[NeurIPS 2025 Spotlight] Implementación oficial de Spatial-MLLM: Mejorando las Capacidades de M…
477 · aigc
compartemultimodal-large-language-modelsmultimodal
VisionReasoner
[ICLR 2026] VisionReasoner: Percepción Visual Integrada en Razonamiento Unificado a través del…
348 · counting-objects
compartemultimodal-large-language-modelsmultimodal
EVF-SAM
Código oficial de "EVF-SAM: Fusión Temprana de Visión-Lenguaje para el Modelo Segmenta Cualquie…
505 · multimodal
compartemultimodal-large-language-modelsmultimodal
Awesome-Medical-Large-Language-Models
Artículos seleccionados sobre Modelos de Lenguaje Grande en el ámbito de la Salud y Medicina
390 · large-language-models
compartemultimodal-large-language-models
Ovis-U1
Un modelo unificado que integra sin problemas comprensión multimodal, generación de texto a ima…
450 · image-editing
compartemultimodal-large-language-models
PicoMLXServer
La forma más fácil de ejecutar los LLMs más rápidos basados en MLX localmente
327 · ai
compartellama3
cambrian-s
Cambrian-S: Hacia la Supersensación Espacial en Video
560 · computer-vision
compartemultimodal-large-language-models
NEO
Serie NEO: Modelos de visión-lenguaje nativos desde primeros principios
888 · agi
compartemultimodal-large-language-modelsmultimodal
visualwebarena
VisualWebArena es un banco de pruebas para agentes multimodales.
482 · agents
compartemultimodal
star-vector
StarVector es un modelo base para la generación de SVG que transforma la vectorización en una t…
4.6k · llm
compartemultimodal-large-language-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.