LLaMA-Omni è un modello di interazione vocale end-to-end a bassa latenza e alta qualità costruito su Llama-3.1-8B-Instruct, mirato a raggiungere capacità vocali a livello GPT-4o.
Interagisci con un modello di linguaggio vocale che genera risposte testuali e vocali basate su istruzioni parlate.
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiLLaMA-Omni è un modello di interazione vocale end-to-end a bassa latenza e alta qualità costruito su Llama-3.1-8B-Instruct, mirato a raggiungere capacità vocali a livello GPT-4o.
LLaMA-Omni ha 3.1k stelle su GitHub. È stato forkato 224 volte. LLaMA-Omni è scritto principalmente in Python. È in sviluppo attivo dal 2024. LLaMA-Omni è disponibile con licenza Apache-2.0. I suoi temi principali sono: large-language-models, multimodal-large-language-models, speech-interaction, speech-language-model.
LLaMA-Omni è un modello di interazione vocale end-to-end a bassa latenza e alta qualità costruito su Llama-3.1-8B-Instruct, mirato a raggiungere capacità vocali a livello GPT-4o.
LLaMA-Omni è un progetto open source. È rilasciato con licenza Apache-2.0.
Sì. LLaMA-Omni è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
LLaMA-Omni è disponibile con licenza Apache-2.0.
LLaMA-Omni è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/ictnlp-llama-omni.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.