Lista curada de conjuntos de dados e ferramentas para pós-treinamento.
Navegue por uma coleção de conjuntos de dados e ferramentas projetadas para melhorar grandes modelos de linguagem após o treinamento.
Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.
Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.
Grátis · sem cartão · cancele quando quiserLista curada de conjuntos de dados e ferramentas para pós-treinamento.
llm-datasets tem 4.7k estrelas no GitHub. Foi bifurcado 391 vezes. Está em desenvolvimento ativo desde 2024. Os seus principais temas são: data, dataset, llm.
Lista curada de conjuntos de dados e ferramentas para pós-treinamento.
llm-datasets é um projeto de código aberto.
Sim. llm-datasets é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.
Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.
[](https://opensourceai.tech/project/mlabonne-llm-datasets.html)
Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.