Home Progetti GigaAM
GigaAM
Python

GigaAM

Modello fondazionale per compiti di riconoscimento vocale

di salute-developers · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Lingua
emotion-recognitionfoundation-modelsself-supervised-learningMITPython
Visualizza su GitHub
In parole semplici

Utilizza un modello di riconoscimento vocale addestrato su più lingue per trascrivere audio con alta precisione.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
GigaAM — GitHub preview card
📈 Storia delle stelle
689688
2026-07-202026-08-31
📈 Segui GigaAM

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Modello fondazionale per compiti di riconoscimento vocale

GigaAM ha 688 stelle su GitHub. È stato forkato 93 volte. GigaAM è scritto principalmente in Python. È in sviluppo attivo dal 2024. GigaAM è disponibile con licenza MIT. I suoi temi principali sono: emotion-recognition, foundation-models, self-supervised-learning, speech-recognition.

Frequently asked questions

Che cos'è GigaAM?

Modello fondazionale per compiti di riconoscimento vocale

GigaAM è open source?

GigaAM è un progetto open source. È rilasciato con licenza MIT.

GigaAM è gratuito?

Sì. GigaAM è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è GigaAM?

GigaAM è disponibile con licenza MIT.

In quale linguaggio è scritto GigaAM?

GigaAM è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — GigaAM

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=salute-developers-gigaam)](https://olud.ai/project/salute-developers-gigaam.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
self-supervised-speech-recognition
trascrizione da voce a testo con apprendimento auto-supervisionato basato sul framework wav2vec…
380 · self-supervised-learning
condivideself-supervised-learningspeech-recognition
byol-pytorch
Implementazione utilizzabile di "Bootstrap Your Own Latent" apprendimento auto-supervisionato,…
1.9k · artificial-intelligence
condivideself-supervised-learning
Emotion-detection
Rilevamento delle emozioni facciali in tempo reale utilizzando deep learning.
1.4k · computer-vision
condivideemotion-recognition
kaldi-gstreamer-server
Server di riconoscimento vocale full-duplex in tempo reale, basato sul toolkit Kaldi e sul fram…
1.1k · speech-recognition
condividespeech-recognition
FastASR
Questo è un progetto di inferenza ASR implementato in C++, che ha poche dipendenze, è facile da…
553 · speech-recognition
condividespeech-recognition
World-Models-Autonomous-Driving-Survey
Un elenco curato di modelli mondiali per la guida autonoma.
524 · autonomous-driving
condivideself-supervised-learning
dragonfly
Framework di riconoscimento vocale che consente scripting e estensione potenti basati su Python…
413 · python
condividespeech-recognition
SfMLearner
Un framework di apprendimento non supervisionato per la stima della profondità e del movimento…
2k · deep-learning
condivideself-supervised-learning
Sound-of-Pixels
Codebase per ECCV18 "Il Suono dei Pixel"
393 · computer-vision
condivideself-supervised-learning
GRID-playground
Piattaforma per lo sviluppo dell'intelligenza robotica generale
345 · computer-vision
condividefoundation-models

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.