Home Progetti Freeze-Omni
Freeze-Omni
Python

Freeze-Omni

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

di VITA-MLLM · GitHub
Stelle
Fork
Creato
Ultimo commit
Lingua
large-language-modelsmultimodal-large-language-modelsspeechPython
Visualizza su GitHub
In parole semplici

Impegnati in conversazioni vocali in tempo reale con un modello intelligente che traduce dialoghi parlati in discorsi.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Freeze-Omni — GitHub preview card
📈 Storia delle stelle
395387
2026-07-202026-08-31
📈 Segui Freeze-Omni

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

Freeze-Omni ha 395 stelle su GitHub. È stato forkato 29 volte. Freeze-Omni è scritto principalmente in Python. È in sviluppo attivo dal 2024. I suoi temi principali sono: large-language-models, multimodal-large-language-models, speech, speech-recognition.

Frequently asked questions

Che cos'è Freeze-Omni?

✨✨Freeze-Omni: Un modello di dialogo speech-to-speech intelligente e a bassa latenza con LLM congelato

Freeze-Omni è open source?

Freeze-Omni è un progetto open source.

Freeze-Omni è gratuito?

Sì. Freeze-Omni è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

In quale linguaggio è scritto Freeze-Omni?

Freeze-Omni è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — Freeze-Omni

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=vita-mllm-freeze-omni)](https://olud.ai/project/vita-mllm-freeze-omni.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
speech-recognition-uk
🇺🇦 Riconoscimento e Sintesi Vocale per l'Ucraino
439 · speech
condividespeechspeech-synthesis
Ming-UniAudio
Ming-UniAudio: LLM per la Comprensione, Generazione e Modifica del Parlato con Rappresentazione…
450 · speech
condividespeechspeech-synthesis
vits2
VITS2: Migliorare la qualità e l'efficienza del Text-to-Speech a singolo stadio con apprendimen…
642 · deep-learning
condividespeechspeech-synthesis
local-talking-llm
Un LLM parlante che gira sul tuo computer senza bisogno di internet.
878 · chatbot
condividespeech-synthesisspeech-recognition
Speech-Backbones
Questo è il repository principale della tecnologia di riconoscimento vocale open-source di Huaw…
604 · speech-processing
condividespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
condividespeech-synthesisspeech-recognition
whisperX
WhisperX: Riconoscimento Vocale Automatico con Timestamp a livello di Parola (& Diarizzazione)
23.1k · asr
condividespeechspeech-recognition
MARS5-TTS
Modello vocale MARS5 (TTS) di CAMB.AI
2.8k · prosody
condividespeechspeech-synthesis
MsEdgeTTS
Un semplice modulo del Servizio di Sintesi Vocale di Azure che utilizza l'API Microsoft Edge Re…
335 · free-tts
condividespeechspeech-synthesis
stt
Strumento di riconoscimento vocale in testo / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
4.7k · speech
condividespeechspeech-recognition

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.