Lista curada de conjuntos de datos y herramientas para post-entrenamiento.
Navega por una colección de conjuntos de datos y herramientas diseñadas para mejorar modelos de lenguaje grandes después del entrenamiento.
Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.
Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.
Gratis · sin tarjeta · cancela cuando quierasLista curada de conjuntos de datos y herramientas para post-entrenamiento.
llm-datasets tiene 4.7k estrellas en GitHub. Se ha bifurcado 391 veces. Se desarrolla activamente desde 2024. Sus temas principales son: data, dataset, llm.
Lista curada de conjuntos de datos y herramientas para post-entrenamiento.
llm-datasets es un proyecto de código abierto.
Sí. llm-datasets es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.
Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.
[](https://opensourceai.tech/project/mlabonne-llm-datasets.html)
Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.