aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
Provided Test PDF in this project doesnt get extracted/analyzed
- Langage dominant
- Python
- Étoiles
- 337
- Forks
- 159
- Métriques de merge des PR
- Aucune PR mergée en 30 j
Description
The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?
Guide de contribution
Ouvrir le guide de contribution
Piste de recherche
Commencez par testdocs/pdfdoc.pdf et suivez son traitement à travers l’état DynamoDB et les journaux CloudWatch. Comparez le chemin d’extraction attendu avec ce qui se produit pour ce PDF d’une seule page, et identifiez pourquoi le traitement reste INPROGRESS. Le travail est considéré comme terminé lorsque le document de test termine l’extraction ou que l’échec est signalé avec une erreur utile.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Stack technique
- aws, python
- Domaine
- backend, cloud
- Type d'issue
- Bug
- Difficulté
- 4/5
- Temps estimé
- 3-5 jours
- Activité
- À l'abandon
- Clarté
- À clarifier
- Accessibilité débutants
- 30/100