aws / aws/amazon-redshift-python-driver

Missing support for PyArrow types in Pandas dataframes

Aperta
#228 1 commento 1 reazione 0 assegnatari Vedi su GitHub
Lingua principale
Python
Stelle
220
Fork
86
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.

It would be awesome if there was support for this.

Guida per i contributori

Apri la guida per i contributori

Direzione di ricerca

La issue cita pd.read_csv, pd.read_parquet e pd.read_sql, ma non indica file o test del repository. Per prima cosa individua i percorsi di ingestione dei dati che costruiscono dataframe Pandas e analizza la gestione attuale di dtype; aggiungi la copertura per dtype_backend='pyarrow', quindi verifica che tutti e tre i percorsi di ingestione gestiscano dataframe basati su PyArrow.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
pandas, python
Ambito
data
Tipo di issue
Funzionalità
Difficoltà
4/5
Tempo stimato
3-5 giorni
Stato di attività
Ferma
Chiarezza
Da chiarire
Idoneità per principianti
30/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.