aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

TextType not in Response object from textract

Offen
#23 0 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
Python
Sterne
337
Forks
159
PR-Merge-Kennzahlen
Keine gemergten PRs in 30 T.

Beschreibung

When I run a deploy this project and run a png through using the lambda the response object for `item["BlockType"] == "WORD"` does not include an `item["TextType"]` key.

However if I run this either manually using the test.py or creating a function to call textract from my machine, it does bring this key back.

I am guessing that this project is using an older version of the boto3 api, however i am not sure how to update that. Thanks!

You can see the "TextType" parameter is supposed to come back here: [Textract API](https://docs.aws.amazon.com/textract/latest/dg/API_DetectDocumentText.html)

Beitragsleitfaden

Beitragsleitfaden öffnen

Rechercherichtung

Beginne mit test.py und vergleiche dessen Textract-Antwort mit der Antwort der bereitgestellten Lambda-Funktion bei der Verarbeitung einer PNG-Datei. Untersuche, wie das Projekt boto3/Textract paketiert und aufruft, und überprüfe anschließend, dass WORD-Blöcke in der bereitgestellten Antwort TextType wie in der verlinkten API-Referenz dokumentiert enthalten.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
aws, python
Bereich
api, cloud
Issue-Typ
Bug
Schwierigkeit
3/5
Geschätzter Aufwand
1-2 Tage
Aktivitätsstatus
Veraltet
Klarheit
Größtenteils klar
Anfängerfreundlichkeit
35/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.