aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

Sleep time not connected to usage constraints

Aperta
#54 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Lingua principale
Python
Stelle
337
Fork
159
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

In the job results processor the sleep on longer pdfs creates large delays. Can this instead be inferred from usage limits rather than an arbitrary setting of 5?

https://github.com/aws-samples/amazon-textract-serverless-large-scale-document-processing/blob/2d8b97cffb78d7160c8d332f9f39ca18c3e6704b/textract-pipeline/lambda/jobresultprocessor/lambda_function.py#L28

Guida per i contributori

Apri la guida per i contributori

Direzione di ricerca

Inizia da textract-pipeline/lambda/jobresultprocessor/lambda_function.py alla riga 28, quindi leggi il flusso circostante di elaborazione dei risultati dei job e il suo utilizzo dell’impostazione fissa di sleep pari a 5. Individua i limiti di utilizzo rilevanti di Amazon Textract e definisci come ricavare da essi il ritardo. Il lavoro è completato quando i PDF più lunghi non comportano più ritardi arbitrariamente elevati e il processore continua a rispettare tali limiti.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
aws, python
Ambito
backend, cloud
Tipo di issue
Bug
Difficoltà
3/5
Tempo stimato
1-2 giorni
Stato di attività
Ferma
Chiarezza
Abbastanza chiara
Idoneità per principianti
38/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.