aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
Sleep time not connected to usage constraints
- Lingua principale
- Python
- Stelle
- 337
- Fork
- 159
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Descrizione
In the job results processor the sleep on longer pdfs creates large delays. Can this instead be inferred from usage limits rather than an arbitrary setting of 5?
https://github.com/aws-samples/amazon-textract-serverless-large-scale-document-processing/blob/2d8b97cffb78d7160c8d332f9f39ca18c3e6704b/textract-pipeline/lambda/jobresultprocessor/lambda_function.py#L28
Guida per i contributori
Apri la guida per i contributori
Direzione di ricerca
Inizia da textract-pipeline/lambda/jobresultprocessor/lambda_function.py alla riga 28, quindi leggi il flusso circostante di elaborazione dei risultati dei job e il suo utilizzo dell’impostazione fissa di sleep pari a 5. Individua i limiti di utilizzo rilevanti di Amazon Textract e definisci come ricavare da essi il ritardo. Il lavoro è completato quando i PDF più lunghi non comportano più ritardi arbitrariamente elevati e il processore continua a rispettare tali limiti.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Valutazione
- Stack tecnologico
- aws, python
- Ambito
- backend, cloud
- Tipo di issue
- Bug
- Difficoltà
- 3/5
- Tempo stimato
- 1-2 giorni
- Stato di attività
- Ferma
- Chiarezza
- Abbastanza chiara
- Idoneità per principianti
- 38/100