apache / apache/parquet-java

Vectorized Read

Abierto
#1,463 0 comentarios 0 reacciones 0 asignados Ver en GitHub
Component: Parquet Priority: Major Type: enhancement
Lenguaje dominante
Java
Estrellas
3.1k
Forks
1.6k
Merge medio
3 d 12 h
PR fusionados (30 d)
33

Descripción

The goal is to implement more CPU efficient vectorized readers for columns.
Vectorized execution engines can use them and skip assembly altogether.

**Reporter**: [Julien Le Dem](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=julienledem) / @julienledem

**Note**: *This issue was originally created as [PARQUET-424](https://issues.apache.org/jira/browse/PARQUET-424). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Línea de trabajo

El issue no menciona archivos, pruebas ni puntos de entrada. Empieza por examinar las implementaciones de lectores de columnas en el repositorio y determina qué Reader-APIs usarían los motores de ejecución vectorizada. El issue no define un alcance de implementación específico ni criterios de finalización comprobables, por lo que deben aclararse antes de comenzar el trabajo.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
java
Área
data-engineering
Tipo de issue
Nueva funcionalidad
Dificultad
5/5
Tiempo estimado
Más de una semana
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
25/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.