case insensitive field matching behavior different from iceberg-python and iceberg-java
- Langage dominant
- C++
- Étoiles
- 221
- Forks
- 124
- Merge moyen
- 1 j 16 h
- PR mergées (30 j)
- 21
Description
https://github.com/apache/iceberg-cpp/pull/180 added support for `GetFieldByName` with `case_sensitive` argument. Its behavior is different from Python and Java Iceberg implementations which could result in inconsistent behavior when used together.
Python/Java are unicode/multibyte aware. iceberg-cpp is not. An example where this breaks e.g. column names containing e.g. "Latin Capital Letter I with Dot Above" https://www.compart.com/en/unicode/U+0130.
Does not affect me directly at this moment.
Guide de contribution
Aucun guide de contribution indexé pour ce dépôt
Piste de recherche
Commencez par l’implémentation de GetFieldByName et le comportement introduit par apache/iceberg-cpp#180. Comparez la correspondance insensible à la casse avec les implémentations Iceberg en Python et en Java, en utilisant comme exemple un nom de colonne contenant U+0130. Le travail est considéré comme terminé lorsque iceberg-cpp gère les noms Unicode et multioctets de manière cohérente avec ces implémentations, avec une couverture pour l’exemple.
Rédigé par le modèle d'indexation à partir du texte de l'issue.
Évaluation
- Stack technique
- cpp
- Domaine
- databases
- Type d'issue
- Bug
- Difficulté
- 4/5
- Temps estimé
- 3-5 jours
- Activité
- Calme
- Clarté
- Plutôt claire
- Accessibilité débutants
- 48/100