[CPP] Unable to read files written by parquet-cpp from parquet-tools
- Vorherrschende Sprache
- Java
- Sterne
- 3.1k
- Forks
- 1.6k
- Ø Merge
- 3 T. 12 Std.
- Gemergte PRs (30 T.)
- 33
Beschreibung
I could not read files written by parquet-cpp from parquet-tools and Hive.
Setting field ids in the schema metadata seems to be the problem. We should make setting the field_id optional.
**Reporter**: [Deepak Majeti](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=mdeepak) / @majetideepak
#### Original Issue Attachments:
- [parquet_cpp_example.parquet](https://issues.apache.org/jira/secure/attachment/12849181/parquet_cpp_example.parquet)
**Note**: *This issue was originally created as [PARQUET-838](https://issues.apache.org/jira/browse/PARQUET-838). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Rechercherichtung
Beginne damit, den Fehler mit der angehängten Datei parquet_cpp_example.parquet mithilfe von parquet-tools und Hive zu reproduzieren, und untersuche anschließend, wie Feld-IDs in den Schema-Metadaten von parquet-java geschrieben werden. Als abgeschlossen gilt die Aufgabe, wenn von parquet-cpp geschriebene Dateien von parquet-tools und Hive gelesen werden können, sofern Feld-IDs nicht erforderlich sind.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- cpp, java
- Bereich
- data-engineering
- Issue-Typ
- Bug
- Schwierigkeit
- 3/5
- Geschätzter Aufwand
- 1-2 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Größtenteils klar
- Anfängerfreundlichkeit
- 45/100