apache / apache/parquet-java

Add measurement of compression/decompression time

Ouverte
#1,760 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
Component: Java Component: Parquet Priority: Major Type: enhancement
Langage dominant
Java
Étoiles
3.1k
Forks
1.6k
Merge moyen
3 j 12 h
PR mergées (30 j)
33

Description

As we compress/decompress a full page at a time, it is easy to measure with negligible overhead.
We should measure the time spent in compressing/decompressing and put that in a hadoop counter.
This way we have visibility in time spend compressing/decompressing.

**Reporter**: [Julien Le Dem](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=julienledem) / @julienledem

**Note**: *This issue was originally created as [PARQUET-219](https://issues.apache.org/jira/browse/PARQUET-219). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Guide de contribution

Aucun guide de contribution indexé pour ce dépôt

Piste de recherche

L’issue ne nomme aucun fichier, test ni point d’entrée. Repérez les chemins de compression et de décompression des pages complètes ainsi que leur intégration aux compteurs Hadoop, puis vérifiez que le temps écoulé de compression et de décompression est exposé via des compteurs avec une surcharge de mesure négligeable.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
hadoop, java
Domaine
observability
Type d'issue
Fonctionnalité
Difficulté
4/5
Temps estimé
3-5 jours
Activité
À l'abandon
Clarté
Plutôt claire
Accessibilité débutants
35/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.