Home Progetti Freeze-Omni
Freeze-Omni

Freeze-Omni

di VITA-MLLM · GitHub

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Licenza non specificata
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Freeze-Omni — GitHub preview card
📈 Storia delle stelle
389388
2026-07-202026-07-29
📈 Segui Freeze-Omni

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

Freeze-Omni ha 388 stelle su GitHub. È stato forkato 29 volte. Freeze-Omni è scritto principalmente in Python. È in sviluppo attivo dal 2024. I suoi temi principali sono: large-language-models, multimodal-large-language-models, speech, speech-recognition.

Frequently asked questions

Che cos'è Freeze-Omni?

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

Freeze-Omni è open source?

Freeze-Omni è un progetto open source.

Freeze-Omni è gratuito?

Sì. Freeze-Omni è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto Freeze-Omni?

Freeze-Omni è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — Freeze-Omni

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=vita-mllm-freeze-omni)](https://opensourceai.tech/project/vita-mllm-freeze-omni.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
Ming-UniAudio
Ming-UniAudio: LLM per la Comprensione, Generazione e Modifica del Parlato con Rappresentazione…
451 · speech
condividespeechspeech-synthesis
CleanS2S
Agente interattivo Speech-to-Speech di alta qualità e streaming in un unico file. 只用一个文件实现的流式全双…
534 · ai
condividespeech-to-speechspeech-synthesis
speech-recognition-uk
🇺🇦 Riconoscimento e Sintesi Vocale per l'Ucraino
440 · speech
condividespeechspeech-synthesis
local-talking-llm
Un LLM parlante che gira sul tuo computer senza bisogno di internet.
883 · chatbot
condividespeech-synthesisspeech-recognition
Speech-Backbones
Questo è il repository principale della tecnologia di riconoscimento vocale open-source di Huaw…
604 · speech-processing
condividespeech-synthesisspeech-recognition
BayLing-Speech
LLaMA-Omni è un modello di interazione vocale end-to-end a bassa latenza e alta qualità costrui…
3.1k · large-language-models
condividespeech-to-speechmultimodal-large-language-models
annyang
💬 Riconoscimento vocale per il tuo sito
6.8k · speech
condividespeechspeech-recognition
stt
Strumento di riconoscimento vocale in testo / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
4.7k · speech
condividespeechspeech-recognition
allosaurus
Allosaurus è un riconoscitore universale di telefoni pre-addestrato per più di 2000 lingue
737 · phonetics
condividespeechspeech-recognition
java-speech-api
L'API di riconoscimento vocale J.A.R.V.I.S. è progettata per essere semplice ed efficiente, uti…
542 · api
condividespeechspeech-synthesis

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.