aws-samples / aws-samples/amazon-textract-serverless-large-scale-document-processing

Provided Test PDF in this project doesnt get extracted/analyzed

Abierto
#45 3 comentarios 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Python
Estrellas
337
Forks
159
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

The pdfdoc.pdf in the testdocs folder in this project is a simple 1 page PDF. The document doesnt seem to complete extraction. DynamoDB status is InPROGRESS. No error messages in any of the Cloudwatch logs. Anyone know how to track down what the issue might be?

Guía de contribución

Abrir la guía de contribución

Línea de trabajo

Comienza con testdocs/pdfdoc.pdf y sigue su procesamiento a través del estado de DynamoDB y los logs de CloudWatch. Compara la ruta de extracción esperada con lo que ocurre con este PDF de una sola página, e identifica por qué el procesamiento permanece en INPROGRESS. Se considera terminado cuando el documento de prueba completa la extracción o el fallo se muestra con un error útil.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
aws, python
Área
backend, cloud
Tipo de issue
Error
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
30/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.