AlibabaResearch / AlibabaResearch/AdvancedLiterateMachinery

processing of the pre-training dataset IIT CDIP 1.0

Abierto
#82 1 comentario 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
C++
Estrellas
1.8k
Forks
195
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

Can you please provide the code used to process the pre-training dataset IIT CDIP 1.0? I am now trying to do retraining weights for use with a new encoder. Any help from the developers would be greatly appreciated.

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Evaluación

Este issue todavía no se ha evaluado.

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.