Home Progetti GigaAM
GigaAM

GigaAM

di salute-developers · GitHub

Modello fondazionale per compiti di riconoscimento vocale

Visualizza su GitHub
In parole semplici

Utilizza un modello di riconoscimento vocale addestrato su più lingue per trascrivere audio con alta precisione.

⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
GigaAM — GitHub preview card
📈 Storia delle stelle
712688
2026-07-202026-07-29
📈 Segui GigaAM

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Modello fondazionale per compiti di riconoscimento vocale

GigaAM ha 712 stelle su GitHub. È stato forkato 95 volte. GigaAM è scritto principalmente in Python. È in sviluppo attivo dal 2024. GigaAM è disponibile con licenza MIT. I suoi temi principali sono: emotion-recognition, foundation-models, self-supervised-learning, speech-recognition.

Frequently asked questions

Che cos'è GigaAM?

Modello fondazionale per compiti di riconoscimento vocale

GigaAM è open source?

GigaAM è un progetto open source. È rilasciato con licenza MIT.

GigaAM è gratuito?

Sì. GigaAM è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è GigaAM?

GigaAM è disponibile con licenza MIT.

In quale linguaggio è scritto GigaAM?

GigaAM è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
OpenSourceAI badge — GigaAM

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=salute-developers-gigaam)](https://opensourceai.tech/project/salute-developers-gigaam.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →
byol-pytorch
Implementazione utilizzabile di "Bootstrap Your Own Latent" apprendimento auto-supervisionato,…
1.9k · artificial-intelligence
condivideself-supervised-learning
ModelsGenesis
[MICCAI 2019 Young Scientist Award] [MEDIA 2020 Best Paper Award] Models Genesis, uno dei primi…
789 · 3d-model
condivideself-supervised-learningfoundation-models
Emotion-recognition
Riconoscimento delle emozioni in tempo reale
1.2k · computer-vision
condivideemotion-recognition
kaldi-gstreamer-server
Server di riconoscimento vocale full-duplex in tempo reale, basato sul toolkit Kaldi e sul fram…
1.1k · speech-recognition
condividespeech-recognition
FastASR
Questo è un progetto di inferenza ASR implementato in C++, che ha poche dipendenze, è facile da…
553 · speech-recognition
condividespeech-recognition
self-supervised-speech-recognition
trascrizione da voce a testo con apprendimento auto-supervisionato basato sul framework wav2vec…
380 · self-supervised-learning
condivideself-supervised-learningspeech-recognition
World-Models-Autonomous-Driving-Survey
Un elenco curato di modelli mondiali per la guida autonoma.
526 · autonomous-driving
condivideself-supervised-learning
dragonfly
Framework di riconoscimento vocale che consente scripting e estensione potenti basati su Python…
415 · python
condividespeech-recognition
VLABench
Repo ufficiale di VLABench, un benchmark su larga scala progettato per valutare equamente VLA,…
454 · embodied
condividefoundation-models
sc_depth_pl
SC-Depth (V1, V2 e V3) per la stima della profondità monoculare non supervisionata Pagina web:…
487 · computer-vision
condivideself-supervised-learning

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.