LLaMA-Omni es un modelo de interacción de voz de extremo a extremo de baja latencia y alta calidad construido sobre Llama-3.1-8B-Instruct, con el objetivo de lograr capacidades de voz al nivel de GPT-4o.
Interactúa con un modelo de lenguaje hablado que genera respuestas de texto y voz basadas en instrucciones habladas.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasLLaMA-Omni es un modelo de interacción de voz de extremo a extremo de baja latencia y alta calidad construido sobre Llama-3.1-8B-Instruct, con el objetivo de lograr capacidades de voz al nivel de GPT-4o.
LLaMA-Omni tiene 3.1k estrellas en GitHub. Se ha bifurcado 224 veces. LLaMA-Omni está escrito principalmente en Python. Se desarrolla activamente desde 2024. LLaMA-Omni está disponible bajo la licencia Apache-2.0. Sus temas principales son: large-language-models, multimodal-large-language-models, speech-interaction, speech-language-model.
LLaMA-Omni es un modelo de interacción de voz de extremo a extremo de baja latencia y alta calidad construido sobre Llama-3.1-8B-Instruct, con el objetivo de lograr capacidades de voz al nivel de GPT-4o.
LLaMA-Omni es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.
Sí. LLaMA-Omni es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
LLaMA-Omni está disponible bajo la licencia Apache-2.0.
LLaMA-Omni está escrito principalmente en Python.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://olud.ai/project/ictnlp-llama-omni.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.