Início Projetos data-juicer
data-juicer
Python

data-juicer

Processamento de dados para e com modelos fundacionais! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

por datajuicer · GitHub
Estrelas
Forks
Tendências
Licença
Criado
Último commit
Categoria
Linguagem
datadata-analysisdata-pipelineApache-2.0Python
Ver no GitHub
Em palavras simples

Transforme dados brutos em informações organizadas e prontas para IA com uma ferramenta de processamento de dados flexível que escala facilmente.

Mantem este projeto?

Reivindique a sua pagina: indexada seja qual for a posicao, traduzida em seis linguas e enriquecida com as suas palavras.

Reivindicar esta pagina →
data-juicer — GitHub preview card
📈 Histórico de estrelas
7.0k6.6k
2026-07-042026-08-31
📈 Acompanhe data-juicer

Receba um alerta por e-mail no próximo lançamento ou quando começar a bombar.

Grátis · sem cartão · cancele quando quiser
Receber alertas por e-mail →
📄 Sobre

Processamento de dados para e com modelos fundacionais! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

data-juicer tem 7k estrelas no GitHub. Foi bifurcado 412 vezes. data-juicer é escrito principalmente em Python. Está em desenvolvimento ativo desde 2023. data-juicer está disponível sob a licença Apache-2.0. Os seus principais temas são: data, data-analysis, data-pipeline, data-processing.

Frequently asked questions

O que é data-juicer?

Processamento de dados para e com modelos fundacionais! 🍎 🍋 🌽 ➡️ ➡️🍸 🍹 🍷

data-juicer é de código aberto?

data-juicer é um projeto de código aberto. É distribuído sob a licença Apache-2.0.

data-juicer é gratuito?

Sim. data-juicer é gratuito e de código aberto — você pode usá-lo, modificá-lo e hospedá-lo por conta própria.

Sob que licença está data-juicer?

data-juicer está disponível sob a licença Apache-2.0.

Em que linguagem data-juicer está escrito?

data-juicer é escrito principalmente em Python.

🏅 Mantenedor deste projeto?
olud.ai badge — data-juicer

Adicione este badge ao vivo ao seu README — suas estrelas do GitHub e classificação no diretório, atualizadas diariamente.

[![olud.ai](https://olud.ai/badge.php?tool=datajuicer-data-juicer)](https://olud.ai/project/datajuicer-data-juicer.html)
Mais opções de badge →
🧬 Partilha ADN com🧬 Ver o mapa de ADN →
Python
Este repositório ajuda você a aprender Python e Aprendizado de Máquina do zero.
2.2k · data
partilhadata-visualizationdata
streamlit
Streamlit — Uma maneira mais rápida de construir e compartilhar aplicativos de dados.
45.3k · data-analysis
partilhadata-visualizationdata-analysis
gradio
Construa e compartilhe aplicativos de aprendizado de máquina encantadores, tudo em Python. 🌟 Dê…
43.2k · data-analysis
partilhadata-visualizationdata-analysis
machine_learning_complete
Um repositório abrangente de aprendizado de máquina contendo mais de 30 notebooks sobre diferen…
5k · computer-vision
partilhadata-visualizationdata-analysis
mito
Extensões Jupyter que ajudam você a escrever código mais rápido: Chat de IA ciente do contexto,…
2.6k · ai
partilhadatadata-analysis
Data-Science-Hacks
Data Science Hacks consiste em dicas e truques para ajudá-lo a se tornar um melhor cientista de…
432 · computer-vision
partilhadatadata-analysis
deepnote
Deepnote é uma substituição direta para Jupyter com um design voltado para IA, interface elegan…
3k · artificial-intelligence
partilhadatadata-analysis
Book6_First-Course-in-Data-Science
Book_6_《数据有道》 | Livro Íris: De adição e subtração a aprendizado de máquina; todos são bem-vin…
2.7k · data
partilhadata-visualizationdata
ml-workspace
🛠 IDE baseada na web tudo-em-um especializada em aprendizado de máquina e ciência de dados.
3.5k · anaconda
partilhadata-visualizationdata-analysis
responsible-ai-toolbox
A Caixa de Ferramentas de AI Responsável é um conjunto de ferramentas que fornece interfaces de…
1.8k · data-analysis
partilhadata-visualizationdata-analysis

Medido a partir dos topics do GitHub comuns aos dois projetos, ponderados pela sua raridade.