aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

Provided Test PDF in this project doesnt get extracted/analyzed

Offen
#45 3 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
Python
Sterne
337
Forks
159
PR-Merge-Kennzahlen
Keine gemergten PRs in 30 T.

Beschreibung

The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?

Beitragsleitfaden

Beitragsleitfaden öffnen

Rechercherichtung

Beginne mit testdocs/pdfdoc.pdf und verfolge seine Verarbeitung anhand des DynamoDB-Status und der CloudWatch-Logs. Vergleiche den erwarteten Extraktionspfad mit dem, was bei diesem einseitigen PDF geschieht, und ermittle, warum die Verarbeitung INPROGRESS bleibt. Als erledigt gilt die Aufgabe, wenn das Testdokument die Extraktion abschließt oder der Fehler mit einer hilfreichen Fehlermeldung sichtbar gemacht wird.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
aws, python
Bereich
backend, cloud
Issue-Typ
Bug
Schwierigkeit
4/5
Geschätzter Aufwand
3-5 Tage
Aktivitätsstatus
Veraltet
Klarheit
Muss geklärt werden
Anfängerfreundlichkeit
30/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.