apache / apache/parquet-java

Vectorized Read

Ouverte
#1,463 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
Component: Parquet Priority: Major Type: enhancement
Langage dominant
Java
Étoiles
3.1k
Forks
1.6k
Merge moyen
3 j 12 h
PR mergées (30 j)
33

Description

The goal is to implement more CPU efficient vectorized readers for columns.
Vectorized execution engines can use them and skip assembly altogether.

**Reporter**: [Julien Le Dem](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=julienledem) / @julienledem

**Note**: *This issue was originally created as [PARQUET-424](https://issues.apache.org/jira/browse/PARQUET-424). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Guide de contribution

Aucun guide de contribution indexé pour ce dépôt

Piste de recherche

L’issue ne nomme aucun fichier, test ou point d’entrée. Commencez par examiner les implémentations de lecteurs de colonnes dans le dépôt et déterminez quelles Reader-APIs les moteurs d’exécution vectorisée utiliseraient. L’issue ne définit ni périmètre d’implémentation précis ni critères d’achèvement testables ; ceux-ci doivent donc être clarifiés avant de commencer le travail.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
java
Domaine
data-engineering
Type d'issue
Fonctionnalité
Difficulté
5/5
Temps estimé
Plus d'une semaine
Activité
À l'abandon
Clarté
À clarifier
Accessibilité débutants
25/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.