Multi-Encoding Display and Editing Support in Codex Editor
Nobody has claimed this yet.
- Dominant language
- Rust
- Stars
- 125k
- Forks
- 19.4k
- PR merge metrics
- PR metrics pending
Description
What variant of Codex are you using?
Codex
What feature would you like to see?
Codex 편집기의 다중 문자 인코딩 표시·편집 기능 제안
Codex를 사용해 오래된 임베디드 C 프로젝트를 정리하고 있습니다.
작업하면서 문자 인코딩과 관련해 한 가지 개선 제안을 드리고 싶습니다.
현재 프로젝트의 소스 파일은 EUC-KR 인코딩을 사용하고 있습니다. 이런 프로젝트에서는 한글 주석이 깨져 보이거나, AI가 파일을 수정하는 과정에서 원래의 문자 인코딩이나 문자열의 실제 바이트 값이 의도치 않게 변경될 가능성이 있습니다.
이 문제는 한국어의 EUC-KR에만 해당하지는 않습니다. 일본의 Shift_JIS, 중국권의 GBK/Big5, Windows-125x 계열 등 다양한 문자 인코딩을 사용하는 프로젝트에서도 비슷한 문제가 발생할 수 있습니다.
또한 임베디드 개발에서는 하나의 파일 전체가 하나의 문자 인코딩만 사용한다고 가정하기 어려운 경우도 있습니다.
예를 들어 소스 코드와 주석은 EUC-KR로 작성되어 있지만, 특정 문자열이나 데이터 배열은 UTF-8로 저장되어 있을 수 있습니다. 여러 언어를 표시하거나 외부 장비와 통신하는 제품이라면 하나의 소스 파일 안에서도 서로 다른 문자 인코딩의 데이터가 함께 존재할 수 있습니다.
따라서 Codex 편집기에서 파일 단위뿐 아니라 문자열이나 데이터 영역 단위로 문자 인코딩을 확인하고 다룰 수 있는 기능이 있으면 매우 유용할 것 같습니다.
제안하는 기능은 다음과 같습니다.
- 파일의 문자 인코딩을 자동으로 감지하고, 원본 인코딩을 유지할 수 있는 기능
- UTF-8뿐 아니라 EUC-KR/CP949, Shift_JIS, GBK/Big5, Windows-125x 등 다양한 문자 인코딩 지원
- 하나의 파일 안에서도 문자열이나 데이터 영역별로 서로 다른 인코딩을 인식하고 표시하는 기능
- 문자열이나 데이터 위에 마우스를 올리면 현재 인코딩과 다른 인코딩으로 해석한 결과를 미리 보여주는 기능
- 예를 들어 같은 바이트열을 EUC-KR, UTF-8, Shift_JIS 등으로 각각 해석한 결과를 비교할 수 있는 기능
- 선택한 문자열이나 데이터 영역만 원하는 인코딩으로 변환하는 기능
- 문자 입력 시 해당 문자열을 어떤 인코딩으로 저장할지 선택할 수 있는 기능
- 서로 다른 인코딩의 문자열이나 데이터를 색상 또는 다른 시각적 표시로 구분하는 기능
- AI가 코드를 수정할 때 파일의 인코딩이나 문자열의 실제 바이트 값이 변경될 경우 이를 감지하고 경고하는 기능
0xB0, 0xA1...과 같은 바이트 배열도 선택하여 여러 문자 인코딩으로 해석한 결과를 확인할 수 있는 기능
특히 중요한 점은 문자를 어떻게 표시할 것인가와 실제로 어떤 바이트를 저장할 것인가를 분리해서 다루는 것이라고 생각합니다.
임베디드 개발에서는 문자열의 실제 바이트 값 자체가 디스플레이 데이터, 폰트 테이블, 통신 데이터 또는 외부 장비와의 호환성에 직접 사용되는 경우가 많습니다. 따라서 모든 소스 파일을 UTF-8로 변환하는 것만으로는 해결할 수 없는 프로젝트도 존재합니다.
Codex는 단순한 텍스트 편집기가 아니라 AI가 직접 코드를 읽고 수정하는 도구이기 때문에, 다양한 문자 인코딩을 안전하게 인식하고 원본 바이트를 보존하면서 편집할 수 있는 기능이 추가된다면 오래된 프로젝트뿐 아니라 새로운 임베디드 및 국제화 프로젝트의 유지보수와 개발에도 폭넓게 도움이 될 것이라 생각합니다.
Additional information
No response
Contributor guide
First steps
- Read the whole issue, then the project's contributing guide.
- Comment on the issue to say you are picking it up — it saves two people doing the same work.
- Fork the repository and make your change on a branch.
- Open a pull request that references the issue number.
Research direction
The issue names no files, tests, or entry points to begin with. First identify where Codex handles file reading, encoding detection, editing, and AI-applied changes; done would require a defined, tested scope for preserving and selectively interpreting multiple encodings.
Written by the indexing model from the issue text.
Assessment
- Tech stack
- rust
- Domain
- developer-experience, tooling
- Issue type
- Feature
- Difficulty
- 5/5
- Estimated time
- Over a week
- Activity status
- Active
- Clarity
- Needs clarification
- Newbie friendliness
- 25/100