Inicio Proyectos data-juicer
data-juicer
Python

data-juicer

¡Procesamiento de datos para y con modelos base! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

por datajuicer · GitHub
Estrellas
Ramas
Tendencias
Licencia
Creado
Último commit
Categoría
Lenguaje
datadata-analysisdata-pipelineApache-2.0Python
Ver en GitHub
En palabras simples

Transforma datos en bruto en información organizada y lista para IA con una herramienta de procesamiento de datos flexible que se escala fácilmente.

¿Mantienes este proyecto?

Reivindica su pagina: indexada sea cual sea su posicion, traducida a seis idiomas y enriquecida con tus propias palabras.

Reivindicar esta pagina →
data-juicer — GitHub preview card
📈 Historial de estrellas
7.0k6.6k
2026-07-042026-08-31
📈 Sigue data-juicer

Recibe una alerta por correo en su próximo lanzamiento o cuando despegue — no te pierdas nada.

Gratis · sin tarjeta · cancela cuando quieras
Recibir alertas por email →
📄 Acerca de

¡Procesamiento de datos para y con modelos base! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

data-juicer tiene 7k estrellas en GitHub. Se ha bifurcado 412 veces. data-juicer está escrito principalmente en Python. Se desarrolla activamente desde 2023. data-juicer está disponible bajo la licencia Apache-2.0. Sus temas principales son: data, data-analysis, data-pipeline, data-processing.

Frequently asked questions

¿Qué es data-juicer?

¡Procesamiento de datos para y con modelos base! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

¿data-juicer es de código abierto?

data-juicer es un proyecto de código abierto. Se distribuye bajo la licencia Apache-2.0.

¿data-juicer es gratis?

Sí. data-juicer es gratuito y de código abierto: puedes usarlo, modificarlo y alojarlo tú mismo.

¿Bajo qué licencia está data-juicer?

data-juicer está disponible bajo la licencia Apache-2.0.

¿En qué lenguaje está escrito data-juicer?

data-juicer está escrito principalmente en Python.

🏅 ¿Mantenedor de este proyecto?
olud.ai badge — data-juicer

Agrega este distintivo en vivo a tu README — tus estrellas de GitHub y rango en el directorio, actualizados diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=datajuicer-data-juicer)](https://olud.ai/project/datajuicer-data-juicer.html)
Más opciones de distintivos →
🧬 Comparte ADN con🧬 Ver el mapa de ADN →
Python
Este repositorio te ayuda a aprender Python y Aprendizaje Automático desde cero.
2.2k · data
compartedata-visualizationdata
streamlit
Streamlit — Una forma más rápida de construir y compartir aplicaciones de datos.
45.3k · data-analysis
compartedata-visualizationdata-analysis
gradio
Construye y comparte aplicaciones de aprendizaje automático encantadoras, todo en Python. 🌟 ¡Da…
43.2k · data-analysis
compartedata-visualizationdata-analysis
machine_learning_complete
Un repositorio completo de aprendizaje automático que contiene más de 30 cuadernos sobre difere…
5k · computer-vision
compartedata-visualizationdata-analysis
mito
Extensiones de Jupyter que te ayudan a escribir código más rápido: Chat AI consciente del conte…
2.6k · ai
compartedatadata-analysis
Data-Science-Hacks
Data Science Hacks consiste en consejos y trucos para ayudarte a convertirte en un mejor cientí…
432 · computer-vision
compartedatadata-analysis
deepnote
Deepnote es un reemplazo directo para Jupyter con un diseño centrado en IA, interfaz elegante,…
3k · artificial-intelligence
compartedatadata-analysis
Book6_First-Course-in-Data-Science
Book_6_《数据有道》 | 鸢尾花书:从加减乘除到机器学习;欢迎大家批评指正!纠错多的同学会得到赠书感谢!
2.7k · data
compartedata-visualizationdata
ml-workspace
🛠 IDE basado en la web todo en uno especializado en aprendizaje automático y ciencia de datos.
3.5k · anaconda
compartedata-visualizationdata-analysis
responsible-ai-toolbox
La Caja de Herramientas de AI Responsable es un conjunto de herramientas que proporciona interf…
1.8k · data-analysis
compartedata-visualizationdata-analysis

Medido a partir de los topics de GitHub comunes a ambos proyectos, ponderados por su rareza.