Parquet file can not be read properly when it starts with an underscore
- 主要言語
- Java
- スター
- 3.1k
- フォーク
- 1.6k
- 平均マージ
- 3日 12時間
- マージ済み PR(30日)
- 33
説明
When a Parquet file starts with an underscore,
- parquet-tools head fails
- Hive/Impala will not show any data in external tables
If the underscore is deleted, everything works as expected. I don't know if this is expected behaviour - but if so, it should probably be documented.
**Environment**: Cloudera CDH 5.10.1 (parquet-tools-1.5.0-cdh5.10.1.jar)
Mac OS Sierra 10.12.4 (parquet-tools-1.9.0.jar)
**Reporter**: [Jurgis Pods](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=pederpansen)
**Note**: *This issue was originally created as [PARQUET-971](https://issues.apache.org/jira/browse/PARQUET-971). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*
コントリビューションガイド
このリポジトリのコントリビューションガイドは索引されていません
調査の方向性
ソースファイル、テスト、エントリーポイントは指定されていません。まず、名前がアンダースコアで始まるファイルで parquet-tools の失敗を再現し、その後 Hive および Impala と動作を比較して、意図された結果がコードの修正なのかドキュメント化なのかを判断してください。動作が修正されるか、明確に文書化されれば完了です。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- java
- 領域
- data-engineering
- issue の種類
- バグ
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 25/100