aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

How to get particular page Form-data.

Ouverte
#41 1 commentaire 0 réactions 0 personnes assignées Voir sur GitHub
Langage dominant
Python
Étoiles
337
Forks
159
Métriques de merge des PR
Aucune PR mergée en 30 j

Description

I Have added the entire PDF file to S3Bucket via amazons3Client.PutObjectAsync method and started the analysis by textractClient.StartDocumentTextDetectionAsync method.
while getting the response by textractClient.GetDocumentTextDetectionAsync method I can see all pages data and could able to segregate the Raw/Line data.
My problem is, how can I get the FormData and TableData for a particular page(say I need FormData only for page no 3). Kindly advise on this.

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

Commencez par examiner les appels S3 PutObjectAsync, Textract StartDocumentTextDetectionAsync et GetDocumentTextDetectionAsync décrits dans l’issue, ainsi que les points d’entrée du dépôt pour le traitement des documents. Confirmez comment sont représentées les données de formulaires et de tableaux spécifiques à une page, puis documentez l’approche prise en charge et un exemple clair et complet pour la page 3.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
aws, python
Domaine
documentation
Type d'issue
Documentation
Difficulté
3/5
Temps estimé
1-2 jours
Activité
À l'abandon
Clarté
À clarifier
Accessibilité débutants
25/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.