Parquet file can not be read properly when it starts with an underscore
- Langage dominant
- Java
- Étoiles
- 3.1k
- Forks
- 1.6k
- Merge moyen
- 3 j 12 h
- PR mergées (30 j)
- 33
Description
When a Parquet file starts with an underscore,
- parquet-tools head fails
- Hive/Impala will not show any data in external tables
If the underscore is deleted, everything works as expected. I don't know if this is expected behaviour - but if so, it should probably be documented.
**Environment**: Cloudera CDH 5.10.1 (parquet-tools-1.5.0-cdh5.10.1.jar)
Mac OS Sierra 10.12.4 (parquet-tools-1.9.0.jar)
**Reporter**: [Jurgis Pods](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=pederpansen)
**Note**: *This issue was originally created as [PARQUET-971](https://issues.apache.org/jira/browse/PARQUET-971). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*
Guide de contribution
Aucun guide de contribution indexé pour ce dépôt
Piste de recherche
Aucun fichier source, test ou point d’entrée n’est indiqué. Commencez par reproduire l’échec de parquet-tools avec un fichier dont le nom commence par un trait de soulignement, puis comparez le comportement avec Hive et Impala et déterminez si le résultat attendu est une correction du code ou de la documentation ; le travail est terminé lorsque le comportement est corrigé ou clairement documenté.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Stack technique
- java
- Domaine
- data-engineering
- Type d'issue
- Bug
- Difficulté
- 4/5
- Temps estimé
- 3-5 jours
- Activité
- À l'abandon
- Clarté
- À clarifier
- Accessibilité débutants
- 25/100