Inicio Proyectos Freeze-Omni
Freeze-Omni

Freeze-Omni

por VITA-MLLM · GitHub

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

Ver en GitHub
⭐ Estrellas
🍴 Ramas
📜 Licencia
Licencia no especificada
📅 Creado
🔄 Último commit
🏷️ Categoría
💻 Lenguaje
¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
Freeze-Omni — GitHub preview card
📈 Historial de estrellas
389388
2026-07-202026-07-29
📈 Sigue Freeze-Omni

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

Freeze-Omni tiene 388 estrellas en GitHub. Se ha bifurcado 29 veces. Freeze-Omni está escrito principalmente en Python. Se desarrolla activamente desde 2024. Sus temas principales son: large-language-models, multimodal-large-language-models, speech, speech-recognition.

Frequently asked questions

¿Qué es Freeze-Omni?

✨✨Freeze-Omni: Un Modelo de Diálogo de Voz-a-Voz Inteligente y de Baja Latencia con LLM Congelado

¿Freeze-Omni es de código abierto?

Freeze-Omni es un proyecto de código abierto.

¿Freeze-Omni es gratis?

Sí. Freeze-Omni es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿En qué lenguaje está escrito Freeze-Omni?

Freeze-Omni está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
OpenSourceAI badge — Freeze-Omni

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=vita-mllm-freeze-omni)](https://opensourceai.tech/project/vita-mllm-freeze-omni.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Ming-UniAudio
Ming-UniAudio: LLM de Voz para Comprensión, Generación y Edición Conjunta con Representación Un…
451 · speech
compartespeechspeech-synthesis
CleanS2S
Agente interactivo de voz a voz de alta calidad y streaming en un solo archivo. 只用一个文件实现的流式全双工…
534 · ai
compartespeech-to-speechspeech-synthesis
speech-recognition-uk
🇺🇦 Reconocimiento y Síntesis de Voz para Ucraniano
440 · speech
compartespeechspeech-synthesis
local-talking-llm
Un LLM hablante que se ejecuta en tu propia computadora sin necesidad de internet.
883 · chatbot
compartespeech-synthesisspeech-recognition
Speech-Backbones
Este es el repositorio principal de tecnología de voz de código abierto por el Laboratorio Noah…
604 · speech-processing
compartespeech-synthesisspeech-recognition
BayLing-Speech
LLaMA-Omni es un modelo de interacción de voz de extremo a extremo de baja latencia y alta cali…
3.1k · large-language-models
compartespeech-to-speechmultimodal-large-language-models
annyang
💬 Reconocimiento de voz para tu sitio
6.8k · speech
compartespeechspeech-recognition
stt
Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
4.7k · speech
compartespeechspeech-recognition
allosaurus
Allosaurus es un reconocedor de teléfonos universal preentrenado para más de 2000 idiomas
737 · phonetics
compartespeechspeech-recognition
java-speech-api
La API de voz J.A.R.V.I.S. está diseñada para ser simple y eficiente, utilizando los motores de…
542 · api
compartespeechspeech-synthesis

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.