aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
TextType not in Response object from textract
- Vorherrschende Sprache
- Python
- Sterne
- 337
- Forks
- 159
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
When I run a deploy this project and run a png through using the lambda the response object for `item["BlockType"] == "WORD"` does not include an `item["TextType"]` key.
However if I run this either manually using the test.py or creating a function to call textract from my machine, it does bring this key back.
I am guessing that this project is using an older version of the boto3 api, however i am not sure how to update that. Thanks!
You can see the "TextType" parameter is supposed to come back here: [Textract API](https://docs.aws.amazon.com/textract/latest/dg/API_DetectDocumentText.html)
Beitragsleitfaden
Rechercherichtung
Beginne mit test.py und vergleiche dessen Textract-Antwort mit der Antwort der bereitgestellten Lambda-Funktion bei der Verarbeitung einer PNG-Datei. Untersuche, wie das Projekt boto3/Textract paketiert und aufruft, und überprüfe anschließend, dass WORD-Blöcke in der bereitgestellten Antwort TextType wie in der verlinkten API-Referenz dokumentiert enthalten.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- aws, python
- Bereich
- api, cloud
- Issue-Typ
- Bug
- Schwierigkeit
- 3/5
- Geschätzter Aufwand
- 1-2 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Größtenteils klar
- Anfängerfreundlichkeit
- 35/100