apache / apache/parquet-java

Add measurement of compression/decompression time

Aperta
#1,760 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
Component: Java Component: Parquet Priority: Major Type: enhancement
Lingua principale
Java
Stelle
3.1k
Fork
1.6k
Merge medio
3g 12h
PR unite (30g)
33

Descrizione

As we compress/decompress a full page at a time, it is easy to measure with negligible overhead.
We should measure the time spent in compressing/decompressing and put that in a hadoop counter.
This way we have visibility in time spend compressing/decompressing.

**Reporter**: [Julien Le Dem](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=julienledem) / @julienledem

**Note**: *This issue was originally created as [PARQUET-219](https://issues.apache.org/jira/browse/PARQUET-219). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Guida per i contributori

Nessuna guida per i contributori indicizzata per questo repository

Direzione di ricerca

L’issue non indica file, test o punti di ingresso. Individua i percorsi di compressione e decompressione di pagine complete e la loro integrazione con i contatori Hadoop, quindi verifica che il tempo trascorso per la compressione e la decompressione sia esposto tramite contatori con un overhead di misurazione trascurabile.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
hadoop, java
Ambito
observability
Tipo di issue
Funzionalità
Difficoltà
4/5
Tempo stimato
3-5 giorni
Stato di attività
Ferma
Chiarezza
Abbastanza chiara
Idoneità per principianti
35/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.