klanderfri / klanderfri/CardReaderLibrary
Create better Tesseract trained data
- Langage dominant
- C++
- Étoiles
- 10
- Forks
- 3
- Métriques de merge des PR
- Aucune PR mergée en 30 j
Description
The *eng.traineddata* isn't optimal for identifying Magic titles.
* The Æ for example isn't correctly identified.
* The 'F' in *Spires of Orazca* (transformed from *Thaumatic Compass*) is identified as 'r'.
* 'I' and 'J' in the new font is mistaken for 'l'.
We need to
- [ ] Create a better traineddata-file.
- [ ] Name it *mtg.traineddata* and replace *eng.traineddata* with it.
https://sv.wikipedia.org/wiki/%C3%86
Guide de contribution
Ouvrir le guide de contribution
Piste de recherche
Commencez par examiner l’utilisation actuelle de eng.traineddata et le workflow OCR dans ce dépôt. Déterminez comment les échantillons de titres de cartes Magic sont collectés et entraînés, puis vérifiez qu’un nouveau mtg.traineddata remplace eng.traineddata et reconnaît correctement Æ, le F transformé, ainsi que le I et le J de la nouvelle police.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Domaine
- computer-vision
- Type d'issue
- Fonctionnalité
- Difficulté
- 5/5
- Temps estimé
- Plus d'une semaine
- Activité
- À l'abandon
- Clarté
- Plutôt claire
- Accessibilité débutants
- 25/100