pdf、doc、docx格式文档如何处理
- Lenguaje dominante
- Java
- Estrellas
- 214
- Forks
- 98
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
示例中只有txt和web部分的处理,pdf、doc、docx部分如何处理呢?
CreateDocumentReq createReq = CreateDocumentReq.builder()
.datasetID(datasetID)
.documentBases(Arrays.asList(
DocumentBase.buildWebPage("web doc example", "https://your-website.com"), //create datasets documents by web page
DocumentBase.buildLocalFile("file doc example", "your file content", "txt"))) //create datasets documents by local file
.build();
Guía de contribución
Línea de trabajo
Start with the CreateDocumentReq example and DocumentBase.buildLocalFile usage shown in the issue, then inspect the SDK's document and file-handling entry points for PDF, DOC, and DOCX. Confirm what the SDK supports and what the example should communicate; done means the documented example or limitation answers the question.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- java
- Área
- documentation
- Tipo de issue
- Documentación
- Dificultad
- 3/5
- Tiempo estimado
- 1-2 días
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 35/100