aws / aws/amazon-redshift-python-driver
Missing support for PyArrow types in Pandas dataframes
- Lenguaje dominante
- Python
- Estrellas
- 220
- Forks
- 86
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Descripción
Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.
It would be awesome if there was support for this.
Guía de contribución
Línea de trabajo
El issue menciona pd.read_csv, pd.read_parquet y pd.read_sql, pero no incluye archivos del repositorio ni tests. Primero localiza las rutas de ingestión de datos que construyen dataframes de Pandas e inspecciona el manejo actual de dtype; establece cobertura para dtype_backend='pyarrow' y, después, verifica que las tres rutas de ingestión gestionen dataframes respaldados por PyArrow.
Escrito por el modelo de indexación a partir del texto del issue.
Evaluación
- Stack tecnológico
- pandas, python
- Área
- data
- Tipo de issue
- Nueva funcionalidad
- Dificultad
- 4/5
- Tiempo estimado
- 3-5 días
- Estado de actividad
- Estancado
- Claridad
- Necesita aclaración
- Aptitud para principiantes
- 30/100