AlibabaResearch / AlibabaResearch/AdvancedLiterateMachinery
processing of the pre-training dataset IIT CDIP 1.0
Offen
- Vorherrschende Sprache
- C++
- Sterne
- 1.8k
- Forks
- 195
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
Can you please provide the code used to process the pre-training dataset IIT CDIP 1.0? I am now trying to do retraining weights for use with a new encoder. Any help from the developers would be greatly appreciated.
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Bewertung
Dieses Issue wurde noch nicht bewertet.