aws / aws/amazon-redshift-python-driver

Missing support for PyArrow types in Pandas dataframes

オープン
#228 コメント 1 件 リアクション 1 件 担当者 0 名 GitHub で見る
主要言語
Python
スター
220
フォーク
86
PR マージ指標
30日以内にマージされた PR はありません

説明

Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.

It would be awesome if there was support for this.

コントリビューションガイド

コントリビューションガイドを開く

調査の方向性

Issue では pd.read_csv、pd.read_parquet、pd.read_sql が挙げられていますが、リポジトリのファイルやテストは示されていません。まず、Pandas のデータフレームを構築するデータ取り込みパスを特定し、現在の dtype の処理を調査してください。dtype_backend='pyarrow' のカバレッジを追加し、その後、3 つすべてのデータ取り込みパスが PyArrow ベースのデータフレームを処理できることを確認してください。

索引モデルが issue の本文から書いたものです。

評価

技術スタック
pandas, python
領域
data
issue の種類
機能追加
難易度
4/5
見積もり時間
3〜5日
活発さ
停滞
明瞭さ
説明が足りない
初心者へのやさしさ
30/100

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。