Accueil Projets data_management_LLM
data_management_LLM

data_management_LLM

par ZigeW · GitHub

Collection d'explorations de gestion de données d'entraînement pour de grands modèles de langage

Voir sur GitHub
⭐ Étoiles
🍴 Forks
🔥 Tendances
📜 Licence
Licence non spécifiée
📅 Créé
🔄 Dernier commit
🏷️ Catégorie
Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
data_management_LLM — GitHub preview card
📈 Historique des étoiles
343342
2026-07-202026-07-29
📈 Suivez data_management_LLM

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Collection d'explorations de gestion de données d'entraînement pour de grands modèles de langage

data_management_LLM compte 343 étoiles sur GitHub. Il a été forké 30 fois. Il est développé activement depuis 2023. Ses principaux thèmes sont : instruction-tuning, large-language-models, natural-language-processing, pre-training.

Frequently asked questions

Qu'est-ce que data_management_LLM ?

Collection d'explorations de gestion de données d'entraînement pour de grands modèles de langage

data_management_LLM est-il open source ?

data_management_LLM est un projet open source.

data_management_LLM est-il gratuit ?

Oui. data_management_LLM est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

🏅 Mainteneur de ce projet ?
OpenSourceAI badge — data_management_LLM

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![OpenSourceAI](https://opensourceai.tech/badge.php?tool=zigew-data-management-llm)](https://opensourceai.tech/project/zigew-data-management-llm.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
LLMSurvey
La page officielle GitHub pour l'article d'enquête "Une enquête sur les grands modèles de langa…
12.2k · chain-of-thought
partagepre-traininginstruction-tuning
awesome-self-supervised-gnn
Articles sur le pré-entraînement et l'apprentissage auto-supervisé sur les réseaux de neurones…
1.7k · deep-learning
partagepretrainingpre-training
Craw4LLM
Dépôt officiel pour "Craw4LLM : Web Crawling Efficace pour le Pré-entraînement LLM"
660 · crawler
partagepretrainingpre-training
LLMs-from-scratch
Implémentez un LLM similaire à ChatGPT en PyTorch depuis le début, étape par étape
1k · ai
partagepretraininginstruction-tuning
UNITER
Code de recherche pour l'article ECCV 2020 "UNITER : UNiversal Image-TExt Representation Learni…
799 · pre-training
partagepre-training
bigdetection
BigDetection : Un benchmark à grande échelle pour l'amélioration de la pré-formation des détect…
399 · computer-vision
partagepretraining
curator
Curation de données synthétiques pour l'extraction de données structurées et post-formation
1.7k · agents
partageinstruction-tuningnatural-language-processing
self-instruct
Aligner les modèles de langage pré-entraînés avec des données d'instruction générées par eux-mê…
4.6k · general-purpose-model
partageinstruction-tuning
LlamaFactory
Ajustement Fin-Efficace Unifié de 100+ LLMs & VLMs (ACL 2024)
73.6k · agent
LLaVA
[NeurIPS'23 Oral] Tuning d'instructions visuelles (LLaVA) construit pour des capacités de nivea…
25k · chatbot

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.