aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing
Provided Test PDF in this project doesnt get extracted/analyzed
- Lenguaje dominante
- Python
- Estrellas
- 337
- Forks
- 159
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?
Guía de contribución
Línea de trabajo
Comienza con testdocs/pdfdoc.pdf y sigue su procesamiento a través del estado de DynamoDB y los logs de CloudWatch. Compara la ruta de extracción esperada con lo que ocurre con este PDF de una sola página, e identifica por qué el procesamiento permanece en INPROGRESS. Se considera terminado cuando el documento de prueba completa la extracción o el fallo se muestra con un error útil.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- aws, python
- Área
- backend, cloud
- Tipo de issue
- Error
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 30/100