apache / apache/arrow-java

[Java] Map cannot be written to a Parquet file using DatasetFileWriter

Abierto
#160 9 comentarios 0 reacciones 1 asignado Reclamado por @vibhatha Ver en GitHub
Lenguaje dominante
Java
Estrellas
94
Forks
152
Merge medio
3 d 16 h
PR fusionados (30 d)
11

Descripción

### Describe the bug, including details regarding any error messages, version, and platform.

Trying to write a map column to a parquet file using DatasetFileWriter results in the following error:
`Runtime java.lang.IllegalArgumentException: not all nodes and buffers were consumed. nodes: [ArrowFieldNode [length=2, nullCount=1], ArrowFieldNode [length=0, nullCount=0], ArrowFieldNode [length=0, nullCount=0]] buffers: [ArrowBuf[509], address:140461672595576, capacity:0, ArrowBuf[510], address:140461672595576, capacity:1, ArrowBuf[511], address:140461672595584, capacity:8, ArrowBuf[512], address:140461672595592, capacity:0, ArrowBuf[513], address:140461672595592, capacity:0, ArrowBuf[514], address:140461672595592, capacity:0]
at org.apache.arrow.vector.VectorLoader.load(VectorLoader.java:89)
at org.apache.arrow.vector.ipc.ArrowReader.loadRecordBatch(ArrowReader.java:220)
at org.apache.arrow.vector.ipc.ArrowStreamReader.loadNextBatch(ArrowStreamReader.java:161)
at org.apache.arrow.c.ArrayStreamExporter$ExportedArrayStreamPrivateData.getNext(ArrayStreamExporter.java:72)`

This happens when the data-to-be-written comes from an ArrowFileReader or ArrowStreamReader. This problem may affect more file formats than parquet (and might actually be related to the DatasetFileWriter in general).

### Component(s)

Java, Parquet

Guía de contribución

Abrir la guía de contribución

Evaluación

Este issue todavía no se ha evaluado.

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.