apache / apache/parquet-java

Vectorized Read

Aperta
#1,463 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Component: Parquet Priority: Major Type: enhancement
Lingua principale
Java
Stelle
3.1k
Fork
1.6k
Merge medio
3g 12h
PR unite (30g)
33

Descrizione

The goal is to implement more CPU efficient vectorized readers for columns.
Vectorized execution engines can use them and skip assembly altogether.

**Reporter**: [Julien Le Dem](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=julienledem) / @julienledem

**Note**: *This issue was originally created as [PARQUET-424](https://issues.apache.org/jira/browse/PARQUET-424). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Direzione di ricerca

L’issue non indica file, test o punti di ingresso. Inizia esaminando le implementazioni dei lettori di colonne nel repository e determina quali Reader-API userebbero i motori di esecuzione vettorializzata. L’issue non definisce un ambito di implementazione specifico né criteri di completamento verificabili, quindi è necessario chiarirli prima di iniziare il lavoro.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
java
Ambito
data-engineering
Tipo di issue
Funzionalità
Difficoltà
5/5
Tempo stimato
Più di una settimana
Stato di attività
Ferma
Chiarezza
Da chiarire
Idoneità per principianti
25/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.