Accueil Projets data-juicer
data-juicer
Python

data-juicer

Traitement des données pour et avec des modèles de base ! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

par datajuicer · GitHub
Étoiles
Forks
Licence
Créé
Dernier commit
Catégorie
Langue
datadata-analysisdata-pipelineApache-2.0Python
Voir sur GitHub
En termes simples

Transformez des données brutes en informations organisées, prêtes pour l'IA avec un outil de traitement de données flexible qui évolue facilement.

Vous maintenez ce projet ?

Revendiquez sa page : indexée quel que soit son rang, traduite en six langues, et enrichie de vos propres mots.

Revendiquer cette page →
data-juicer — GitHub preview card
📈 Historique des étoiles
7.0k6.6k
2026-07-042026-08-31
📈 Suivez data-juicer

Recevez une alerte par e-mail à sa prochaine version ou quand il décolle — ne ratez plus rien.

Gratuit · sans carte · désinscription à tout moment
Recevoir des alertes e-mail →
📄 À propos

Traitement des données pour et avec des modèles de base ! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

data-juicer compte 7k étoiles sur GitHub. Il a été forké 412 fois. data-juicer est écrit principalement en Python. Il est développé activement depuis 2023. data-juicer est disponible sous licence Apache-2.0. Ses principaux thèmes sont : data, data-analysis, data-pipeline, data-processing.

Frequently asked questions

Qu'est-ce que data-juicer ?

Traitement des données pour et avec des modèles de base ! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

data-juicer est-il open source ?

data-juicer est un projet open source. Il est distribué sous licence Apache-2.0.

data-juicer est-il gratuit ?

Oui. data-juicer est gratuit et open source — vous pouvez l'utiliser, le modifier et l'héberger vous-même.

Sous quelle licence est data-juicer ?

data-juicer est disponible sous licence Apache-2.0.

Dans quel langage data-juicer est-il écrit ?

data-juicer est écrit principalement en Python.

🏅 Mainteneur de ce projet ?
olud.ai badge — data-juicer

Ajoutez ce badge en direct à votre README — vos étoiles GitHub et votre classement dans le répertoire, actualisés quotidiennement.

[![olud.ai](https://olud.ai/badge.php?tool=datajuicer-data-juicer)](https://olud.ai/project/datajuicer-data-juicer.html)
Plus d'options de badge →
🧬 Partage son ADN avec🧬 Voir la cartographie ADN →
Python
Ce dépôt vous aide à apprendre Python et l'apprentissage automatique depuis le début.
2.2k · data
partagedata-visualizationdata
streamlit
Streamlit — Une manière plus rapide de créer et partager des applications de données.
45.3k · data-analysis
partagedata-visualizationdata-analysis
gradio
Créez et partagez des applications d'apprentissage automatique agréables, le tout en Python. 🌟…
43.2k · data-analysis
partagedata-visualizationdata-analysis
machine_learning_complete
Un dépôt complet d'apprentissage automatique contenant plus de 30 notebooks sur différents conc…
5k · computer-vision
partagedata-visualizationdata-analysis
mito
Extensions Jupyter qui vous aident à écrire du code plus rapidement : Chat IA conscient du cont…
2.6k · ai
partagedatadata-analysis
Data-Science-Hacks
Data Science Hacks consiste en des astuces et conseils pour vous aider à devenir un meilleur da…
432 · computer-vision
partagedatadata-analysis
deepnote
Deepnote est un remplacement direct pour Jupyter avec un design axé sur l'IA, une interface élé…
3k · artificial-intelligence
partagedatadata-analysis
Book6_First-Course-in-Data-Science
Livre_6_《数据有道》 | Livre Iris : De l'addition et soustraction à l'apprentissage automatique ; t…
2.7k · data
partagedata-visualizationdata
ml-workspace
🛠 IDE web tout-en-un spécialisé pour l'apprentissage automatique et la science des données.
3.5k · anaconda
partagedata-visualizationdata-analysis
responsible-ai-toolbox
La boîte à outils AI responsable est un ensemble d'outils fournissant des interfaces utilisateu…
1.8k · data-analysis
partagedata-visualizationdata-analysis

Mesuré à partir des topics GitHub communs aux deux projets, pondérés par leur rareté.