Startseite Projekte GigaAM
GigaAM
Python

GigaAM

Grundlagenmodell für Sprachverarbeitungsaufgaben

von salute-developers · GitHub
Sterne
Forks
Lizenz
Erstellt
Letzter Commit
Sprache
emotion-recognitionfoundation-modelsself-supervised-learningMITPython
Auf GitHub ansehen
In einfachen Worten

Verwenden Sie ein Sprachmodell, das auf mehreren Sprachen trainiert wurde, um Audio mit hoher Genauigkeit zu transkribieren.

Betreuen Sie dieses Projekt?

Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.

Diese Seite beanspruchen →
GigaAM — GitHub preview card
📈 Sternhistorie
689688
2026-07-202026-08-31
📈 GigaAM verfolgen

Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.

Kostenlos · ohne Karte · jederzeit abbestellbar
E-Mail-Alerts erhalten →
📄 Über

Grundlagenmodell für Sprachverarbeitungsaufgaben

GigaAM hat 688 Sterne auf GitHub. Es wurde 93-mal geforkt. GigaAM ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. GigaAM ist unter der MIT-Lizenz verfügbar. Die Hauptthemen sind: emotion-recognition, foundation-models, self-supervised-learning, speech-recognition.

Frequently asked questions

Was ist GigaAM?

Grundlagenmodell für Sprachverarbeitungsaufgaben

Ist GigaAM Open Source?

GigaAM ist ein Open-Source-Projekt. Es wird unter der MIT-Lizenz veröffentlicht.

Ist GigaAM kostenlos?

Ja. GigaAM ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.

Unter welcher Lizenz steht GigaAM?

GigaAM ist unter der MIT-Lizenz verfügbar.

In welcher Sprache ist GigaAM geschrieben?

GigaAM ist hauptsächlich in Python geschrieben.

🏅 Wartender dieses Projekts?
olud.ai badge — GigaAM

Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.

[![olud.ai](https://olud.ai/badge.php?tool=salute-developers-gigaam)](https://olud.ai/project/salute-developers-gigaam.html)
Weitere Abzeichenoptionen →
🧬 Teilt DNA mit🧬 DNA-Karte ansehen →
self-supervised-speech-recognition
Sprach-zu-Text mit selbstüberwachtem Lernen basierend auf dem wav2vec 2.0-Framework
380 · self-supervised-learning
teiltself-supervised-learningspeech-recognition
byol-pytorch
Verwendbare Implementierung von "Bootstrap Your Own Latent" selbstüberwachtem Lernen von Deepmi…
1.9k · artificial-intelligence
teiltself-supervised-learning
Emotion-detection
Echtzeit-Gesichtsemotionserkennung mit Deep Learning.
1.4k · computer-vision
teiltemotion-recognition
kaldi-gstreamer-server
Echtzeit-Voll-Duplex-Spracherkennungsserver, basierend auf dem Kaldi-Toolkit und dem GStreamer-…
1.1k · speech-recognition
teiltspeech-recognition
FastASR
这是一个用C++实现ASR推理的项目,它依赖很少,安装也很简单,推理速度很快,在树莓派4B等ARM平台也可以流畅的运行。 支持的模型是由Google的Transformer模型中优化而来,数…
553 · speech-recognition
teiltspeech-recognition
World-Models-Autonomous-Driving-Survey
Eine kuratierte Liste von Weltmodellen für autonomes Fahren.
524 · autonomous-driving
teiltself-supervised-learning
dragonfly
Spracherkennungs-Framework, das leistungsstarkes, Python-basiertes Scripting und Erweiterungen…
413 · python
teiltspeech-recognition
SfMLearner
Ein unüberwachtes Lernframework zur Schätzung von Tiefe und Ego-Bewegung aus monokularen Videos…
2k · deep-learning
teiltself-supervised-learning
Sound-of-Pixels
Codebasis für ECCV18 "The Sound of Pixels"
393 · computer-vision
teiltself-supervised-learning
GRID-playground
Plattform zur Entwicklung allgemeiner Robotikintelligenz
345 · computer-vision
teiltfoundation-models

Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.