Outil pour générer des ensembles de données synthétiques de haute qualité
Créez des ensembles de données synthétiques de haute qualité pour améliorer les performances des modèles de langage de grande taille.
Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.
Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.
Gratuit · sans carte · désinscription à tout momentOutil pour générer des ensembles de données synthétiques de haute qualité
synthetic-data-kit compte 1.6k étoiles sur GitHub. Il a été forké 235 fois. synthetic-data-kit est écrit principalement en Python. Il est développé activement depuis 2025. synthetic-data-kit est disponible sous licence MIT. Ses principaux thèmes sont : data, generation, llm, python.
Outil pour générer des ensembles de données synthétiques de haute qualité
synthetic-data-kit est un projet open source. Il est distribué sous licence MIT.
Oui. synthetic-data-kit est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.
synthetic-data-kit est disponible sous licence MIT.
synthetic-data-kit est écrit principalement en Python.
Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.
[](https://opensourceai.tech/project/meta-llama-synthetic-data-kit.html)
Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.