urllib.parse.parse_qs should not parse a query string containing illegal characters
未關閉
還沒有人認領這個 Issue。
stdlib
type-bug
- 主要語言
- Python
- 星號
- 77.2k
- 分支
- 35.9k
- PR 合併指標
- PR 指標待擷取
描述
Bug report
Bug description:
urllib.parse.parse_qsl will happily parse a query string containing '#'.
from urllib.parse import parse_qsl
parse_qsl('foo=#', strict_parsing=True)
Output is [('foo', '#')] .
But 'foo=#' is an invalid query string according to RFC 3986. Similarly, '[', and ']' are excluded from the set of valid query characters, but parse_qsl parses strings like 'foo=[' and 'foo=]' . In the absence of any allocation of responsibility, this looks like a bug to me.
CPython versions tested on:
3.13
Operating systems tested on:
macOS
Linked PRs
- gh-152530
貢獻指南
從這裡開始
- 先讀完整個 Issue,再讀專案的貢獻指南。
- 在 Issue 下留言說明你要接手 —— 這能避免兩個人做同樣的事。
- Fork 儲存庫,在一個分支上完成修改。
- 送出 Pull Request,並在描述裡引用這個 Issue 編號。
研究方向
從 urllib.parse.parse_qsl 開始,檢查查詢字元如何根據 RFC 3986 進行驗證。先查看現有的解析測試和連結的 PR gh-152530;當諸如 '#'、'[' 和 ']' 之類的非法字元按照已達成共識的行為得到一致處理,並由測試涵蓋時,即視為完成。
由索引模型根據 Issue 內容生成。
評估
- 技術堆疊
- python
- 領域
- backend-api-design
- Issue 類型
- 缺陷
- 難度
- 3/5
- 預估耗時
- 1-2 天
- 活躍度
- 停滯
- 描述清晰度
- 描述清楚
- 新手友好度
- 35/100