aws / aws/amazon-redshift-python-driver
Missing support for PyArrow types in Pandas dataframes
オープン
- 主要言語
- Python
- スター
- 220
- フォーク
- 86
- PR マージ指標
- 30日以内にマージされた PR はありません
説明
Most of the data ingestion utilities (`pd.read_csv`, `pd.read_parquet`, `pd.read_sql`) since Pandas 2.2 include a `dtype_backend='pyarrow'` option to use PyArrow types instead of NumPy backend.
It would be awesome if there was support for this.
コントリビューションガイド
調査の方向性
Issue では pd.read_csv、pd.read_parquet、pd.read_sql が挙げられていますが、リポジトリのファイルやテストは示されていません。まず、Pandas のデータフレームを構築するデータ取り込みパスを特定し、現在の dtype の処理を調査してください。dtype_backend='pyarrow' のカバレッジを追加し、その後、3 つすべてのデータ取り込みパスが PyArrow ベースのデータフレームを処理できることを確認してください。
索引モデルが issue の本文から書いたものです。
評価
- 技術スタック
- pandas, python
- 領域
- data
- issue の種類
- 機能追加
- 難易度
- 4/5
- 見積もり時間
- 3〜5日
- 活発さ
- 停滞
- 明瞭さ
- 説明が足りない
- 初心者へのやさしさ
- 30/100