AlibabaResearch / AlibabaResearch/AdvancedLiterateMachinery

processing of the pre-training dataset IIT CDIP 1.0

Aperta
#82 1 commento 0 reazioni 0 assegnatari Vedi su GitHub
Lingua principale
C++
Stelle
1.8k
Fork
195
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

Can you please provide the code used to process the pre-training dataset IIT CDIP 1.0? I am now trying to do retraining weights for use with a new encoder. Any help from the developers would be greatly appreciated.

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Valutazione

Questa issue non è ancora stata valutata.

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.