Home Progetti cc2dataset
cc2dataset

cc2dataset

di rom1504 · GitHub

Converti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...

Visualizza su GitHub
⭐ Stelle
🍴 Fork
📜 Licenza
Uso commerciale consentito
📅 Creato
🔄 Ultimo commit
🏷️ Categoria
💻 Lingua
Mantieni questo progetto?

Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.

Rivendica questa pagina →
cc2dataset — GitHub preview card
📈 Storia delle stelle
322321
2026-07-202026-07-29
📈 Segui cc2dataset

Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.

Gratis · senza carta · disdici quando vuoi
Ricevi avvisi via email →
📄 Informazioni

Converti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...

cc2dataset ha 321 stelle su GitHub. È stato forkato 26 volte. cc2dataset è scritto principalmente in Python. È in sviluppo attivo dal 2022. cc2dataset è disponibile con licenza MIT. I suoi temi principali sono: big-data, dataset, multimodal.

Frequently asked questions

Che cos'è cc2dataset?

Converti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...

cc2dataset è open source?

cc2dataset è un progetto open source. È rilasciato con licenza MIT.

cc2dataset è gratuito?

Sì. cc2dataset è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.

Con quale licenza è cc2dataset?

cc2dataset è disponibile con licenza MIT.

In quale linguaggio è scritto cc2dataset?

cc2dataset è scritto principalmente in Python.

🏅 Manutentore di questo progetto?
olud.ai badge — cc2dataset

Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.

[![olud.ai](https://olud.ai/badge.php?tool=rom1504-cc2dataset)](https://olud.ai/project/rom1504-cc2dataset.html)
Altre opzioni di badge →
🧬 Condivide il DNA con🧬 Vedi la mappa del DNA →

Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.