python / python/cpython

Improve `encodings.normalize_encoding` behaviour or docs

Ouverte
#136,702 9 commentaires 0 réactions 1 personne assignée Voir sur GitHub

@StanFromIreland y travaille déjà.

Depuis le 16/7/2025.

stdlib topic-unicode type-bug
Langage dominant
Python
Étoiles
77.2k
Forks
35.9k
Métriques de merge des PR
Métriques de PR en attente

Description

Bug report

Bug description:

This is to wait for https://github.com/python/cpython/issues/55531 / https://github.com/python/cpython/pull/136643

  • This function accepts bytes since https://github.com/python/cpython/commit/98297ee7815939b124156e438b22bd652d67b5db. This is however undocumented, and untested. I propose deprecating (& later removing) it, otherwise it should be documented and tested properly.

  • This function is documented as

    encoding should be ASCII only.

    However, this is only enforced for bytes (see point 1) with a ValueError, and for strings the characters are simply removed. We should be consistent and not depend on input type. I propose enforcing this for strings too with a ValueError.

cc @malemburg (Note, absolutely no rush for this one, we should get the performance issue/C implementation sorted out first :-)

CPython versions tested on:

CPython main branch

Operating systems tested on:

No response

Linked PRs
  • gh-140030
  • gh-141345

Guide de contribution

Ouvrir le guide de contribution

Par où commencer

  1. Lisez l'issue en entier, puis le guide de contribution du projet.
  2. Signalez en commentaire que vous la prenez — cela évite que deux personnes fassent le même travail.
  3. Forkez le dépôt et travaillez sur une branche.
  4. Ouvrez une pull request qui référence le numéro de l'issue.

Évaluation

Cette issue n'a pas encore été évaluée.

Recevez les nouvelles issues par e-mail

Un résumé court des issues GitHub adaptées aux débutants.