apache / apache/parquet-java

Column resolution by ID

Offen
#2,591 1 Kommentar 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Component: Java Component: Parquet Priority: Major Type: enhancement
Vorherrschende Sprache
Java
Sterne
3.1k
Forks
1.6k
Ø Merge
3 T. 12 Std.
Gemergte PRs (30 T.)
33

Beschreibung

Parquet relies on the name. In a lot of usages e.g. schema resolution, this would be a problem. Iceberg uses ID and stored Id/name mappings.

This Jira is to add column ID resolution support.

**Reporter**: [Xinli Shang](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=shangx@uber.com) / @shangxinli
**Assignee**: [Xinli Shang](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=shangx@uber.com) / @shangxinli
#### PRs and other links:
- [GitHub Pull Request #950](https://github.com/apache/parquet-java/pull/950)
- [GitHub Pull Request #950](https://github.com/apache/parquet-mr/pull/950)

**Note**: *This issue was originally created as [PARQUET-2006](https://issues.apache.org/jira/browse/PARQUET-2006). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Rechercherichtung

Beginnen Sie mit der Prüfung des referenzierten GitHub Pull Request #950 und der in der Issue verlinkten Migrationsdokumentation, da hier keine Quelldateien oder Tests genannt werden. Das erklärte Ziel ist die Unterstützung der Auflösung von Spalten-IDs für die Schemaauflösung, aber der Implementierungsumfang und die Kriterien für den Abschluss sind nicht spezifiziert.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
java
Bereich
data-engineering
Issue-Typ
Feature
Schwierigkeit
5/5
Geschätzter Aufwand
Über eine Woche
Aktivitätsstatus
Veraltet
Klarheit
Muss geklärt werden
Anfängerfreundlichkeit
15/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.