klanderfri / klanderfri/CardReaderLibrary

Create better Tesseract trained data

Ouverte
#7 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
bug help wanted
Langage dominant
C++
Étoiles
10
Forks
3
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

The *eng.traineddata* isn't optimal for identifying Magic titles.
* The Æ for example isn't correctly identified.
* The 'F' in *Spires of Orazca* (transformed from *Thaumatic Compass*) is identified as 'r'.
* 'I' and 'J' in the new font is mistaken for 'l'.

We need to
- [ ] Create a better traineddata-file.
- [ ] Name it *mtg.traineddata* and replace *eng.traineddata* with it.

https://sv.wikipedia.org/wiki/%C3%86

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

Commencez par examiner l’utilisation actuelle de eng.traineddata et le workflow OCR dans ce dépôt. Déterminez comment les échantillons de titres de cartes Magic sont collectés et entraînés, puis vérifiez qu’un nouveau mtg.traineddata remplace eng.traineddata et reconnaît correctement Æ, le F transformé, ainsi que le I et le J de la nouvelle police.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Domaine
computer-vision
Type d'issue
Fonctionnalité
Difficulté
5/5
Temps estimé
Plus d'une semaine
Activité
À l'abandon
Clarté
Plutôt claire
Accessibilité débutants
25/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.