Converti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...
Rivendica la sua pagina: indicizzata qualunque sia il rango, tradotta in sei lingue e arricchita con le tue parole.
Ricevi un avviso via email alla prossima release o quando decolla — non perderti nulla.
Gratis · senza carta · disdici quando vuoiConverti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...
cc2dataset ha 321 stelle su GitHub. È stato forkato 26 volte. cc2dataset è scritto principalmente in Python. È in sviluppo attivo dal 2022. cc2dataset è disponibile con licenza MIT. I suoi temi principali sono: big-data, dataset, multimodal.
Converti facilmente il common crawl in un dataset di didascalie e documenti. Immagine/testo Audio/testo Video/testo, ...
cc2dataset è un progetto open source. È rilasciato con licenza MIT.
Sì. cc2dataset è gratuito e open source: puoi usarlo, modificarlo e ospitarlo autonomamente.
cc2dataset è disponibile con licenza MIT.
cc2dataset è scritto principalmente in Python.
Aggiungi questo badge live al tuo README — le tue stelle GitHub e il ranking della directory, aggiornati quotidianamente.
[](https://olud.ai/project/rom1504-cc2dataset.html)
Misurato dai topic GitHub comuni a entrambi i progetti, ponderati per la loro rarita.