Inicio Proyectos GigaAM
GigaAM
Python

GigaAM

Modelo fundamental para tareas de reconocimiento de voz.

por salute-developers · GitHub
Estrellas
Ramas
Licencia
Creado
Último commit
Lenguaje
emotion-recognitionfoundation-modelsself-supervised-learningMITPython
Ver en GitHub
En palabras simples

Utiliza un modelo de reconocimiento de voz entrenado en múltiples idiomas para transcribir audio con alta precisión.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
GigaAM — GitHub preview card
📈 Historial de estrellas
689688
2026-07-202026-08-31
📈 Sigue GigaAM

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Modelo fundamental para tareas de reconocimiento de voz.

GigaAM tiene 688 estrellas en GitHub. Se ha bifurcado 93 veces. GigaAM está escrito principalmente en Python. Se desarrolla activamente desde 2024. GigaAM está disponible bajo la licencia MIT. Sus temas principales son: emotion-recognition, foundation-models, self-supervised-learning, speech-recognition.

Frequently asked questions

¿Qué es GigaAM?

Modelo fundamental para tareas de reconocimiento de voz.

¿GigaAM es de código abierto?

GigaAM es un proyecto de código abierto. Se distribuye bajo la licencia MIT.

¿GigaAM es gratis?

Sí. GigaAM es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está GigaAM?

GigaAM está disponible bajo la licencia MIT.

¿En qué lenguaje está escrito GigaAM?

GigaAM está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — GigaAM

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=salute-developers-gigaam)](https://olud.ai/project/salute-developers-gigaam.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
self-supervised-speech-recognition
transcripción de voz a texto con aprendizaje auto-supervisado basado en el marco wav2vec 2.0
380 · self-supervised-learning
comparteself-supervised-learningspeech-recognition
byol-pytorch
Implementación utilizable de "Bootstrap Your Own Latent" aprendizaje auto-supervisado, de Deepm…
1.9k · artificial-intelligence
comparteself-supervised-learning
Emotion-detection
Detección de Emociones Faciales en Tiempo Real utilizando aprendizaje profundo
1.4k · computer-vision
comparteemotion-recognition
kaldi-gstreamer-server
Servidor de reconocimiento de voz en tiempo real y dúplex completo, basado en el kit de herrami…
1.1k · speech-recognition
compartespeech-recognition
FastASR
Este es un proyecto de inferencia ASR implementado en C++, que tiene pocas dependencias, es fác…
553 · speech-recognition
compartespeech-recognition
World-Models-Autonomous-Driving-Survey
Una lista curada de modelos del mundo para conducción autónoma.
524 · autonomous-driving
comparteself-supervised-learning
dragonfly
Marco de reconocimiento de voz que permite una potente programación y extensión basada en Pytho…
413 · python
compartespeech-recognition
SfMLearner
Un marco de aprendizaje no supervisado para la estimación de profundidad y ego-moción a partir…
2k · deep-learning
comparteself-supervised-learning
Sound-of-Pixels
Base de código para ECCV18 "El Sonido de los Píxeles"
393 · computer-vision
comparteself-supervised-learning
GRID-playground
Plataforma para el Desarrollo de Inteligencia Robótica General
345 · computer-vision
compartefoundation-models

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.