Home Progetti Curator
Curator
Python

Curator

Toolkit scalabile per la pre-elaborazione e curatela dei dati per LLM

di NVIDIA-NeMo · GitHub
Stelle
Fork
Licenza
Creato
Ultimo commit
Categoria
Lingua
datadata-curationdata-prepApache-2.0Python
Visualizza su GitHub
In parole semplici

Costruisci e gestisci pipeline di elaborazione dei dati per grandi set di dati per prepararli all'addestramento AI.

Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
Curator — GitHub preview card
📈 Storia delle stelle
1.74k1.67k
2026-07-202026-08-31
📈 Segui Curator

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Toolkit scalabile per la pre-elaborazione e curatela dei dati per LLM

Curator ha 1.7k stelle su GitHub. È stato forkato 320 volte. Curator è scritto principalmente in Python. È in sviluppo attivo dal 2024. Curator è disponibile con licenza Apache-2.0. I suoi temi principali sono: data, data-curation, data-prep, data-preparation.

Frequently asked questions

Che cos'è Curator?

Toolkit scalabile per la pre-elaborazione e curatela dei dati per LLM

Curator è open source?

Curator è un progetto open source. È rilasciato con licenza Apache-2.0.

Curator è gratuito?

Sì. Curator è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è Curator?

Curator è disponibile con licenza Apache-2.0.

In quale linguaggio è scritto Curator?

Curator è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — Curator

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=nvidia-nemo-curator)](https://olud.ai/project/nvidia-nemo-curator.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.