Inicio Proyectos Freeze-Omni
Freeze-Omni
Python

Freeze-Omni

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

por VITA-MLLM · GitHub
Estrellas
Ramas
Tendencias
Creado
Último commit
Lenguaje
large-language-modelsmultimodal-large-language-modelsspeechPython
Ver en GitHub
En palabras simples

Participa en conversaciones de voz en tiempo real con un modelo inteligente que traduce diálogos hablados en voz.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Freeze-Omni — GitHub preview card
📈 Historial de estrellas
395387
2026-07-202026-08-31
📈 Sigue Freeze-Omni

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

Freeze-Omni tiene 395 estrellas en GitHub. Se ha bifurcado 29 veces. Freeze-Omni está escrito principalmente en Python. Se desarrolla activamente desde 2024. Sus temas principales son: large-language-models, multimodal-large-language-models, speech, speech-recognition.

Frequently asked questions

¿Qué es Freeze-Omni?

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

¿Freeze-Omni es de código abierto?

Freeze-Omni es un proyecto de código abierto.

¿Freeze-Omni es gratis?

Sí. Freeze-Omni es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿En qué lenguaje está escrito Freeze-Omni?

Freeze-Omni está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — Freeze-Omni

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=vita-mllm-freeze-omni)](https://olud.ai/project/vita-mllm-freeze-omni.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
speech-recognition-uk
🇺🇦 Reconocimiento y Síntesis de Voz para Ucraniano
439 · speech
compartespeechspeech-synthesis
Ming-UniAudio
Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Un…
450 · speech
compartespeechspeech-synthesis
vits2
VITS2: Mejora de la Calidad y Eficiencia del Texto a Voz de Etapa Única con Aprendizaje Adversa…
642 · deep-learning
compartespeechspeech-synthesis
local-talking-llm
Un LLM hablante que se ejecuta en tu propia computadora sin necesidad de internet.
878 · chatbot
compartespeech-synthesisspeech-recognition
Speech-Backbones
Este es el repositorio principal de tecnología de voz de código abierto por el Laboratorio Noah…
604 · speech-processing
compartespeech-synthesisspeech-recognition
Irene-Voice-Assistant
Ирина - русский голосовой ассистент для работы оффлайн. Поддерживает скиллы через плагины.
1.1k · python
compartespeech-synthesisspeech-recognition
whisperX
WhisperX: Reconocimiento Automático de Voz con Tiempos de Palabras (& Diarización)
23.1k · asr
compartespeechspeech-recognition
MARS5-TTS
Modelo de voz MARS5 (TTS) de CAMB.AI
2.8k · prosody
compartespeechspeech-synthesis
MsEdgeTTS
Un módulo simple del Servicio de Voz de Azure que utiliza la API de Microsoft Edge Leer en Voz…
335 · free-tts
compartespeechspeech-synthesis
stt
Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
4.7k · speech
compartespeechspeech-recognition

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.