Skalierbares Datenvorverarbeitungs- und Kurations-Toolkit für LLMs
Bauen und verwalten Sie Datenverarbeitungspipelines für große Datensätze, um sie für das KI-Training vorzubereiten.
Beanspruchen Sie die Seite: indexiert unabhangig vom Rang, in sechs Sprachen ubersetzt und mit Ihren eigenen Worten erganzt.
Erhalten Sie eine E-Mail-Benachrichtigung beim nächsten Release oder wenn es durchstartet.
Kostenlos · ohne Karte · jederzeit abbestellbarSkalierbares Datenvorverarbeitungs- und Kurations-Toolkit für LLMs
Curator hat 1.7k Sterne auf GitHub. Es wurde 311-mal geforkt. Curator ist hauptsächlich in Python geschrieben. Es wird seit 2024 aktiv entwickelt. Curator ist unter der Apache-2.0-Lizenz verfügbar. Die Hauptthemen sind: data, data-curation, data-prep, data-preparation.
Skalierbares Datenvorverarbeitungs- und Kurations-Toolkit für LLMs
Curator ist ein Open-Source-Projekt. Es wird unter der Apache-2.0-Lizenz veröffentlicht.
Ja. Curator ist kostenlos und Open Source — Sie können es nutzen, anpassen und selbst hosten.
Curator ist unter der Apache-2.0-Lizenz verfügbar.
Curator ist hauptsächlich in Python geschrieben.
Fügen Sie dieses Live-Abzeichen zu Ihrem README hinzu — Ihre GitHub-Sterne und Verzeichnisrang, täglich aktualisiert.
[](https://olud.ai/project/nvidia-nemo-curator.html)
Ermittelt aus gemeinsamen GitHub-Topics beider Projekte, gewichtet nach ihrer Seltenheit.