Accueil Projets GigaAM
GigaAM
Python

GigaAM

Modèle fondamental pour les tâches de reconnaissance vocale

par salute-developers · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Langue
emotion-recognitionfoundation-modelsself-supervised-learningMITPython
Voir sur GitHub
En termes simples

Utiliser un modèle de reconnaissance vocale entraîné sur plusieurs langues pour transcrire de l'audio avec une grande précision.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
GigaAM — GitHub preview card
📈 Historique des étoiles
689688
2026-07-202026-08-31
📈 Suivez GigaAM

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Modèle fondamental pour les tâches de reconnaissance vocale

GigaAM compte 688 étoiles sur GitHub. Il a été forké 93 fois. GigaAM est écrit principalement en Python. Il est développé activement depuis 2024. GigaAM est disponible sous licence MIT. Ses principaux thèmes sont : emotion-recognition, foundation-models, self-supervised-learning, speech-recognition.

Frequently asked questions

Qu'est-ce que GigaAM ?

Modèle fondamental pour les tâches de reconnaissance vocale

GigaAM est-il open source ?

GigaAM est un projet open source. Il est distribué sous licence MIT.

GigaAM est-il gratuit ?

Oui. GigaAM est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est GigaAM ?

GigaAM est disponible sous licence MIT.

Dans quel langage GigaAM est-il écrit ?

GigaAM est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — GigaAM

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=salute-developers-gigaam)](https://olud.ai/project/salute-developers-gigaam.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
self-supervised-speech-recognition
transcription vocale en texte avec apprentissage auto-supervisé basé sur le cadre wav2vec 2.0
380 · self-supervised-learning
partageself-supervised-learningspeech-recognition
byol-pytorch
Implémentation utilisable de "Bootstrap Your Own Latent" apprentissage auto-supervisé, de Deepm…
1.9k · artificial-intelligence
partageself-supervised-learning
Emotion-detection
Détection d'émotions faciales en temps réel utilisant l'apprentissage profond
1.4k · computer-vision
partageemotion-recognition
kaldi-gstreamer-server
Serveur de reconnaissance vocale en temps réel à duplex intégral, basé sur l'outil Kaldi et le…
1.1k · speech-recognition
partagespeech-recognition
FastASR
这是一个用C++实现ASR推理的项目,它依赖很少,安装也很简单,推理速度很快,在树莓派4B等ARM平台也可以流畅的运行。 支持的模型是由Google的Transformer模型中优化而来,数…
553 · speech-recognition
partagespeech-recognition
World-Models-Autonomous-Driving-Survey
Une liste soigneusement sélectionnée de modèles mondiaux pour la conduite autonome.
524 · autonomous-driving
partageself-supervised-learning
dragonfly
Cadre de reconnaissance vocale permettant un puissant scripting et une extension basés sur Pyth…
413 · python
partagespeech-recognition
SfMLearner
Un cadre d'apprentissage non supervisé pour l'estimation de profondeur et de mouvement égoïste…
2k · deep-learning
partageself-supervised-learning
Sound-of-Pixels
Code source pour ECCV18 "Le son des pixels"
393 · computer-vision
partageself-supervised-learning
GRID-playground
Plateforme pour le développement de l'intelligence robotique générale
345 · computer-vision
partagefoundation-models

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.