AlibabaResearch / AlibabaResearch/AdvancedLiterateMachinery

processing of the pre-training dataset IIT CDIP 1.0

Offen
#82 1 Kommentar 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
C++
Sterne
1.8k
Forks
195
PR-Merge-Kennzahlen
Keine gemergten PRs in 30 T.

Beschreibung

Can you please provide the code used to process the pre-training dataset IIT CDIP 1.0? I am now trying to do retraining weights for use with a new encoder. Any help from the developers would be greatly appreciated.

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Bewertung

Dieses Issue wurde noch nicht bewertet.

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.