aws / aws/amazon-redshift-python-driver
Missing support for PyArrow types in Pandas dataframes
- Lingua principale
- Python
- Stelle
- 220
- Fork
- 86
- Metriche di merge delle PR
- Nessuna PR unita negli ultimi 30g
Descrizione
Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.
It would be awesome if there was support for this.
Guida per i contributori
Apri la guida per i contributori
Direzione di ricerca
La issue cita pd.read_csv, pd.read_parquet e pd.read_sql, ma non indica file o test del repository. Per prima cosa individua i percorsi di ingestione dei dati che costruiscono dataframe Pandas e analizza la gestione attuale di dtype; aggiungi la copertura per dtype_backend='pyarrow', quindi verifica che tutti e tre i percorsi di ingestione gestiscano dataframe basati su PyArrow.
Scritto dal modello di indicizzazione a partire dal testo della issue.
Valutazione
- Stack tecnologico
- pandas, python
- Ambito
- data
- Tipo di issue
- Funzionalità
- Difficoltà
- 4/5
- Tempo stimato
- 3-5 giorni
- Stato di attività
- Ferma
- Chiarezza
- Da chiarire
- Idoneità per principianti
- 30/100