Perform encoding before bloom filters write out
- Langage dominant
- Java
- Étoiles
- 3.1k
- Forks
- 1.6k
- Merge moyen
- 3 j 12 h
- PR mergées (30 j)
- 33
Description
When entropy of bloom filter is low say nearly all 0 or all 1, we may want to consider to use encoding to save space.
**Reporter**: [Junjie Chen](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=junjie) / @chenjunjiedada
**Note**: *This issue was originally created as [PARQUET-1495](https://issues.apache.org/jira/browse/PARQUET-1495). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*
Guide de contribution
Aucun guide de contribution indexé pour ce dépôt
Piste de recherche
L’issue ne nomme aucun fichier, test ni point d’entrée. Commencez par localiser le chemin d’écriture du filtre de Bloom et les tests existants liés à l’encodage, puis déterminez le comportement attendu pour les filtres à faible entropie. La tâche serait terminée lorsqu’une approche d’encodage approuvée et une couverture montrant que les filtres de Bloom sont correctement écrits et peuvent être relus seraient disponibles.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Stack technique
- java
- Domaine
- data-engineering
- Type d'issue
- Fonctionnalité
- Difficulté
- 5/5
- Temps estimé
- Plus d'une semaine
- Activité
- À l'abandon
- Clarté
- À clarifier
- Accessibilité débutants
- 25/100