apache / apache/parquet-java

Decouple Hadoop/Native I/O implementations

Offen
#3,279 1 Kommentar 5 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Type: enhancement
Vorherrschende Sprache
Java
Sterne
3.1k
Forks
1.6k
Ø Merge
3 T. 12 Std.
Gemergte PRs (30 T.)
33

Beschreibung

### Describe the enhancement requested

Provide a clean interface to use hadoop/native io classes. Users should be able to use parquet without hadoop on the classpath. This issue tracks the effort

### Component(s)

_No response_

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Rechercherichtung

Das Issue nennt keine Dateien, Tests oder Einstiegspunkte. Beginne damit, die Hadoop-/native-I/O-Implementierungen in parquet-java und ihre Classpath-Abhängigkeiten zu erfassen; abgeschlossen ist die Aufgabe, wenn Parquet eine saubere Schnittstelle ohne Hadoop im Classpath verwenden kann.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
java
Bereich
backend, data-engineering
Issue-Typ
Feature
Schwierigkeit
5/5
Geschätzter Aufwand
Über eine Woche
Aktivitätsstatus
Veraltet
Klarheit
Muss geklärt werden
Anfängerfreundlichkeit
25/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.