Inicio Proyectos sft_datasets
sft_datasets
chinese-dataset

sft_datasets

Organización de conjuntos de datos SFT de código abierto, se puede complementar en cualquier momento

por chaoswork · GitHub
Estrellas
Ramas
Tendencias
Creado
Último commit
Categoría
chinese-datasetdatasetslarge-language-models
Ver en GitHub
En palabras simples

Accede y descarga una colección de conjuntos de datos para entrenar modelos de lenguaje.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
sft_datasets — GitHub preview card
📈 Historial de estrellas
584581
2026-07-202026-08-31
📈 Sigue sft_datasets

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

Organización de conjuntos de datos SFT de código abierto, se puede complementar en cualquier momento

sft_datasets tiene 584 estrellas en GitHub. Se ha bifurcado 41 veces. Se desarrolla activamente desde 2023. Sus temas principales son: chinese-dataset, datasets, large-language-models, llms.

Frequently asked questions

¿Qué es sft_datasets?

Organización de conjuntos de datos SFT de código abierto, se puede complementar en cualquier momento

¿sft_datasets es de código abierto?

sft_datasets es un proyecto de código abierto.

¿sft_datasets es gratis?

Sí. sft_datasets es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — sft_datasets

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=chaoswork-sft-datasets)](https://olud.ai/project/chaoswork-sft-datasets.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.