Inicio Proyectos stt
stt
Python

stt

Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式

por jianchang512 · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Categoría
Lenguaje
speechspeech-recognitionspeech-to-textGPL-3.0Python
Ver en GitHub
En palabras simples

Convierte el habla de audio y video en texto sin conexión, con opciones para diferentes formatos de salida.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
stt — GitHub preview card
📈 Historial de estrellas
4.68k4.66k
2026-07-072026-08-31
📈 Sigue stt

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式

stt tiene 4.7k estrellas en GitHub. Se ha bifurcado 493 veces. stt está escrito principalmente en Python. Se desarrolla activamente desde 2023. stt está disponible bajo la licencia GPL-3.0. Sus temas principales son: speech, speech-recognition, speech-to-text, stt.

Frequently asked questions

¿Qué es stt?

Herramienta de reconocimiento de voz a texto / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式

¿stt es de código abierto?

stt es un proyecto de código abierto. Se distribuye bajo la licencia GPL-3.0.

¿stt es gratis?

Sí. stt es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo. Su licencia GPL-3.0 es copyleft: toda versión modificada que distribuya debe permanecer bajo la misma licencia.

¿Bajo qué licencia está stt?

stt está disponible bajo la licencia GPL-3.0.

¿En qué lenguaje está escrito stt?

stt está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — stt

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=jianchang512-stt)](https://olud.ai/project/jianchang512-stt.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
whisperX
WhisperX: Reconocimiento Automático de Voz con Tiempos de Palabras (& Diarización)
23.1k · asr
compartespeechspeech-to-text
speech-recognition-uk
🇺🇦 Reconocimiento y Síntesis de Voz para Ucraniano
439 · speech
compartespeechspeech-to-text
annyang
💬 Reconocimiento de voz para tu sitio
6.8k · speech
compartespeechspeech-to-text
react-speech-recognition
💬Reconocimiento de voz para tu aplicación React
842 · react
compartespeech-to-textspeech-recognition
Speech-and-Text
Conversión de voz a texto (PocketSphinx, API de Iflytex, API de Baidu) y de texto a voz (pyttsx…
342 · speech-recognition
compartespeech-to-textspeech-recognition
whisper-playground
Construye aplicaciones web de speech2text en tiempo real usando Whisper de OpenAI https://opena…
833 · machine-learning
compartespeech-to-textspeech-recognition
PreenCut
Herramienta de Recuperación y Recorte de Video Potenciada por AI
405 · asr
compartespeech-to-textspeech-recognition
WhisperS2T
Una Canalización de Voz a Texto Optimizada para el Modelo Whisper que Soporta Múltiples Motores…
577 · asr
compartespeech-to-textspeech-recognition
tensorflow-speech-recognition
🎙Reconocimiento de voz utilizando el marco de aprendizaje profundo tensorflow, redes neuronales…
2.2k · deep-learning
compartespeech-to-textspeech-recognition
whisper-jax
Implementación en JAX del modelo Whisper de OpenAI para hasta 70x de aceleración en TPU.
4.7k · deep-learning
compartespeech-to-textspeech-recognition

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.