Início Projetos sft_datasets
sft_datasets
chinese-dataset

sft_datasets

Organização de conjuntos de dados SFT de código aberto, sempre atualizados

por chaoswork · GitHub
Estrelas
Forks
Tendências
Criado
Último commit
chinese-datasetdatasetslarge-language-models
Ver no GitHub
Em palavras simples

Acesse e baixe uma coleção de conjuntos de dados para treinar modelos de linguagem.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
sft_datasets — GitHub preview card
📈 Histórico de estrelas
584581
2026-07-202026-08-31
📈 Acompanhe sft_datasets

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Organização de conjuntos de dados SFT de código aberto, sempre atualizados

sft_datasets tem 584 estrelas no GitHub. Foi bifurcado 41 vezes. Está em desenvolvimento ativo desde 2023. Os seus principais temas são: chinese-dataset, datasets, large-language-models, llms.

Frequently asked questions

O que é sft_datasets?

Organização de conjuntos de dados SFT de código aberto, sempre atualizados

sft_datasets é de código aberto?

sft_datasets é um projeto de código aberto.

sft_datasets é gratuito?

Sim. sft_datasets é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

🏅 Mantenedor deste projeto?
olud.ai badge — sft_datasets

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=chaoswork-sft-datasets)](https://olud.ai/project/chaoswork-sft-datasets.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.