Occasionally we see data skews in bloom index partitoner
Open
area:index
from-jira
priority:high
status:pr-available
type:improvement
- Dominant language
- Java
- Stars
- 6.2k
- Forks
- 2.5k
- Avg merge
- 2d 8h
- Merged PRs (30d)
- 111
Description
When one file group has lot more keys to be looked up, while most of the other file groups has very few keys to look up, bloom index w/ bucketized partitioners has data skew
## JIRA info
- Link: https://issues.apache.org/jira/browse/HUDI-9135
- Type: Improvement
- Fix version(s):
- 1.1.0
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.