Accueil Projets sft_datasets
sft_datasets
chinese-dataset

sft_datasets

Organisation de jeux de données SFT open source, à compléter à tout moment

par chaoswork · GitHub
Étoiles
Forks
Créé
Dernier commit
Catégorie
chinese-datasetdatasetslarge-language-models
Voir sur GitHub
En termes simples

Accédez et téléchargez une collection de jeux de données pour entraîner des modèles de langage.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
sft_datasets — GitHub preview card
📈 Historique des étoiles
584581
2026-07-202026-08-31
📈 Suivez sft_datasets

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Organisation de jeux de données SFT open source, à compléter à tout moment

sft_datasets compte 584 étoiles sur GitHub. Il a été forké 41 fois. Il est développé activement depuis 2023. Ses principaux thèmes sont : chinese-dataset, datasets, large-language-models, llms.

Frequently asked questions

Qu'est-ce que sft_datasets ?

Organisation de jeux de données SFT open source, à compléter à tout moment

sft_datasets est-il open source ?

sft_datasets est un projet open source.

sft_datasets est-il gratuit ?

Oui. sft_datasets est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

🏅 Mainteneur de ce projet ?
olud.ai badge — sft_datasets

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=chaoswork-sft-datasets)](https://olud.ai/project/chaoswork-sft-datasets.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.