apache / apache/parquet-java

[Vectorized Reader] Lazy Decoding in Vectorized Reader

Offen
#1,827 0 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Component: Java Component: Parquet Priority: Major Type: task
Vorherrschende Sprache
Java
Sterne
3.1k
Forks
1.6k
Ø Merge
3 T. 12 Std.
Gemergte PRs (30 T.)
33

Beschreibung

Do not decode data until required

**Reporter**: [Zhenxiao Luo](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=zhenxiao) / @zhenxiao

**Note**: *This issue was originally created as [PARQUET-302](https://issues.apache.org/jira/browse/PARQUET-302). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Rechercherichtung

Das Issue nennt den Vectorized Reader und verlinkt die Migrationsdokumentation für den ursprünglichen PARQUET-302-Bericht. Lies zuerst diese Migrationsdokumentation und die Einstiegspunkte des Vectorized Reader; das erklärte Ziel besteht darin, das Decodieren von Daten zu vermeiden, bis es erforderlich ist, aber der Payload benennt keine Dateien, Tests oder einen genau festgelegten Umfang für die Fertigstellung.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
java
Bereich
data
Issue-Typ
Feature
Schwierigkeit
5/5
Geschätzter Aufwand
Über eine Woche
Aktivitätsstatus
Veraltet
Klarheit
Muss geklärt werden
Anfängerfreundlichkeit
20/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.