aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
Provided Test PDF in this project doesnt get extracted/analyzed
- Vorherrschende Sprache
- Python
- Sterne
- 337
- Forks
- 159
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?
Beitragsleitfaden
Rechercherichtung
Beginne mit testdocs/pdfdoc.pdf und verfolge seine Verarbeitung anhand des DynamoDB-Status und der CloudWatch-Logs. Vergleiche den erwarteten Extraktionspfad mit dem, was bei diesem einseitigen PDF geschieht, und ermittle, warum die Verarbeitung INPROGRESS bleibt. Als erledigt gilt die Aufgabe, wenn das Testdokument die Extraktion abschließt oder der Fehler mit einer hilfreichen Fehlermeldung sichtbar gemacht wird.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- aws, python
- Bereich
- backend, cloud
- Issue-Typ
- Bug
- Schwierigkeit
- 4/5
- Geschätzter Aufwand
- 3-5 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Muss geklärt werden
- Anfängerfreundlichkeit
- 30/100