Support configurable for DirectByteBufferAllocator from Hadoop Configuration
还没有人认领这个 Issue。
- 主要语言
- Java
- 星标
- 3.1k
- 派生
- 1.6k
- 平均合并
- 3 天 12 小时
- 30 天内合并 PR
- 33
描述
Now in [HadoopReadOptions|([https://github.com/apache/parquet-mr/blob/master/parquet-hadoop/src/main/java/org/apache/parquet/HadoopReadOptions.java#L85]] class, we cannot change default allocator from Hadoop Configuration.
Add a config parquet.allocator.direct.enabled to enable DirectByteBufferAllocator in ParuqetFileReader.
Reporter: ShuMing Li
Related issues:
- ColumnChunkPageWriter uses only heap memory. (relates to)
PRs and other links:
Note: This issue was originally created as PARQUET-1771. Please see the migration documentation for further details.
贡献指南
这个仓库没有索引到贡献指南
从这里开始
- 先读完整个 Issue,再读项目的贡献指南。
- 在 Issue 下留言说明你要接手 —— 这能避免两个人做同样的事。
- Fork 仓库,在一个分支上完成修改。
- 提交 Pull Request,并在描述里引用这个 Issue 编号。
调研方向
从 parquet-hadoop/src/main/java/org/apache/parquet/HadoopReadOptions.java 以及 ParquetFileReader 中选择 allocator 的路径开始。跟踪 Hadoop Configuration 的读取方式,以及 DirectByteBufferAllocator 的选择方式;当 parquet.allocator.direct.enabled 控制该选择,并且未启用时保留现有行为,即表示完成。
由索引模型根据 Issue 内容生成。
评估
- 技术栈
- java
- 领域
- data-engineering
- Issue 类型
- 功能
- 难度
- 3/5
- 预计耗时
- 1-2 天
- 活跃度
- 停滞
- 描述清晰度
- 描述清楚
- 新手友好度
- 25/100