NVIDIA / NVIDIA/GenerativeAIExamples
ERROR:example:Failed to ingest document due to exception Unable to get page count.
Nadie ha tomado este issue todavía.
- Lenguaje dominante
- Jupyter Notebook
- Estrellas
- 4.2k
- Forks
- 1.1k
- Merge medio
- 10 h 15 min
- PR fusionados (30 d)
- 1
Descripción
Followed the instructions from the README and started the example from GenerativeAIExamples/RAG/examples/basic_rag/langchain.
The docker logs of chain-server:
INFO: Started server process [1]
INFO: Waiting for application startup.
INFO:faiss.loader:Loading faiss with AVX2 support.
INFO:faiss.loader:Successfully loaded faiss with AVX2 support.
INFO:RAG.src.chain_server.utils:Using nvidia-ai-endpoints as model engine and nvidia/nv-embedqa-e5-v5 and model for embeddings
INFO:RAG.src.chain_server.utils:Using embedding model nvidia/nv-embedqa-e5-v5 hosted at api catalog
INFO:RAG.src.chain_server.utils:Using milvus collection: nvidia_api_catalog
INFO:RAG.src.chain_server.utils:Vector store created and saved.
INFO: Application startup complete.
INFO: Uvicorn running on http://0.0.0.0:8081 (Press CTRL+C to quit)
INFO: 172.18.0.6:48730 - "GET /documents HTTP/1.1" 200 OK
INFO: 172.18.0.6:40180 - "GET /documents HTTP/1.1" 200 OK
INFO: 172.18.0.6:60014 - "GET /documents HTTP/1.1" 200 OK
INFO: 172.18.0.6:60800 - "GET /documents HTTP/1.1" 200 OK
INFO:pikepdf._core:pikepdf C++ to Python logger bridge initialized
ERROR:example:Failed to ingest document due to exception Unable to get page count. Is poppler installed and in PATH?
ERROR:RAG.src.chain_server.server:Error from POST /documents endpoint. Ingestion of file: /tmp/gradio/b3131f976d42f2c5b2cab5027eeaabec73658e1423259694a7a7d107b65be0bd/test.pdf failed with error: Failed to upload document. Please upload an unstructured text document.
INFO: 172.18.0.6:60810 - "GET /documents HTTP/1.1" 200 OK
INFO: 172.18.0.6:60804 - "POST /documents HTTP/1.1" 500 Internal Server Error
Guía de contribución
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Línea de trabajo
Comienza con las instrucciones de README y el ejemplo en GenerativeAIExamples/RAG/examples/basic_rag/langchain; después, sigue la ruta de ingestión de documentos de chain-server usando los logs indicados. Comprueba cómo el ejemplo gestiona la dependencia de PDF detrás del error de recuento de páginas; se considera completado cuando el ejemplo puede ingerir el PDF subido sin una respuesta 500.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- docker, python
- Área
- ai, backend
- Tipo de issue
- Error
- Dificultad
- 3/5
- Tiempo estimado
- 1-2 días
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 30/100