aws / aws/amazon-redshift-python-driver

Missing support for PyArrow types in Pandas dataframes

Abierto
#228 1 comentario 1 reacción 0 asignados Ver en GitHub
Lenguaje dominante
Python
Estrellas
220
Forks
86
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.

It would be awesome if there was support for this.

Guía de contribución

Abrir la guía de contribución

Línea de trabajo

El issue menciona pd.read_csv, pd.read_parquet y pd.read_sql, pero no incluye archivos del repositorio ni tests. Primero localiza las rutas de ingestión de datos que construyen dataframes de Pandas e inspecciona el manejo actual de dtype; establece cobertura para dtype_backend='pyarrow' y, después, verifica que las tres rutas de ingestión gestionen dataframes respaldados por PyArrow.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
pandas, python
Área
data
Tipo de issue
Nueva funcionalidad
Dificultad
4/5
Tiempo estimado
3-5 días
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
30/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.