aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

Provided Test PDF in this project doesnt get extracted/analyzed

Ouverte
#45 3 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
Langage dominant
Python
Étoiles
337
Forks
159
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

Commencez par testdocs/pdfdoc.pdf et suivez son traitement à travers l’état DynamoDB et les journaux CloudWatch. Comparez le chemin d’extraction attendu avec ce qui se produit pour ce PDF d’une seule page, et identifiez pourquoi le traitement reste INPROGRESS. Le travail est considéré comme terminé lorsque le document de test termine l’extraction ou que l’échec est signalé avec une erreur utile.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
aws, python
Domaine
backend, cloud
Type d'issue
Bug
Difficulté
4/5
Temps estimé
3-5 jours
Activité
À l'abandon
Clarté
À clarifier
Accessibilité débutants
30/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.