duckdb / duckdb/duckdb-python

Missing ROW_GROUPS_PER_FILE argument in write_parquet function

Ouverte Adaptée aux débutants
#386 0 commentaires 0 réactions 0 personnes assignées Voir sur GitHub
needs triage
Langage dominant
Python
Étoiles
187
Forks
112
Merge moyen
13 h 29 min
PR mergées (30 j)
17

Description

### What happens?

```
TypeError: write_parquet(): incompatible function arguments. The following argument types are supported:
1. (self: _duckdb.DuckDBPyRelation, file_name: str, *, compression: object = None, field_ids: object = None, row_group_size_bytes: object = None, row_group_size: object = None, overwrite: object = None, per_thread_output: object = None, use_tmp_file: object = None, partition_by: object = None, write_partition_columns: object = None, append: object = None, filename_pattern: object = None, file_size_bytes: object = None) -> None
```
while invoking the write parquet function with the params that are accepted and documented in https://duckdb.org/docs/current/sql/statements/copy#parquet-options

### To Reproduce

```python
import duckdb

con = duckdb.connect()
con.sql("select 1 as test").write_parquet("test.parquet", row_groups_per_file=2)
```

### OS:

Ubuntu Linux x86_64

### DuckDB Package Version:

1.5.0

### Python Version:

1.13.1

### Full Name:

Niccolò Cantù

### Affiliation:

Norwegian Institute for Nature Research (NINA)

### What is the latest build you tested with? If possible, we recommend testing with the latest nightly build.

I have tested with a stable release

### Did you include all relevant data sets for reproducing the issue?

Not applicable - the reproduction does not require a data set

### Did you include all code required to reproduce the issue?

- [x] Yes, I have

### Did you include all relevant configuration to reproduce the issue?

- [x] Yes, I have

Guide de contribution

Ouvrir le guide de contribution

Piste de recherche

Commencez par le binding Python du point d’entrée write_parquet et comparez ses arguments nommés acceptés avec les options Parquet référencées dans l’issue. Reproduisez l’échec avec la requête fournie, puis vérifiez que row_groups_per_file est accepté et que l’exemple se termine sans TypeError.

Rédigé par le modèle d'indexation à partir du texte de l'issue.

Évaluation

Stack technique
python
Domaine
databases
Type d'issue
Bug
Difficulté
2/5
Temps estimé
1-3 heures
Activité
À l'abandon
Clarté
Clairement spécifiée
Accessibilité débutants
68/100

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.