Many classes in parquet-hadoop belong in parquet-column
- Vorherrschende Sprache
- Java
- Sterne
- 3.1k
- Forks
- 1.6k
- Ø Merge
- 3 T. 12 Std.
- Gemergte PRs (30 T.)
- 33
Beschreibung
There are a handful of classes, like BlockMetaData and some of the other \*MetaData classes that are currentlyin parquet hadoop but aren't hadoop specific. Which force some other classes (like the row group filter) to also live in parquet-hadoop when they really belong in parquet-column
**Reporter**: [Alex Levenson](https://issues.apache.org/jira/secure/ViewProfile.jspa?name=alexlevenson) / @isnotinvain
**Note**: *This issue was originally created as [PARQUET-38](https://issues.apache.org/jira/browse/PARQUET-38). Please see the [migration documentation](https://issues.apache.org/jira/browse/PARQUET-2502) for further details.*
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Rechercherichtung
Beginne damit, BlockMetaData und die anderen *MetaData-Klassen in parquet-hadoop zu lokalisieren, und untersuche dann den Zeilengruppenfilter und seine Modulabhängigkeiten. Das Refactoring ist abgeschlossen, wenn Hadoop-unabhängige Metadaten und zugehörige Filterklassen in parquet-column liegen können, ohne erforderliche Abhängigkeiten zurückzulassen.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- java
- Bereich
- data-engineering
- Issue-Typ
- Refactoring
- Schwierigkeit
- 4/5
- Geschätzter Aufwand
- 3-5 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Größtenteils klar
- Anfängerfreundlichkeit
- 35/100