aRustyDev / aRustyDev/ccgram

Define normalization rules

Aperta
#2 0 commenti 0 reazioni 0 assegnatari Vedi su GitHub
data
Lingua principale
Python
Stelle
0
Fork
0
Metriche di merge delle PR
Nessuna PR unita negli ultimi 30g

Descrizione

## Summary
Define rules for normalizing raw conventional commit data into a consistent format.

## Success Criteria
- [ ] Casing rules defined (lowercase types, scopes, etc.)
- [ ] Whitespace handling documented
- [ ] Character normalization rules (unicode, special chars)
- [ ] Scope canonicalization rules (e.g., aliasing)
- [ ] Rules documented in a format that can be automated

## Context
Raw commit messages vary wildly in formatting. Normalization ensures the n-gram tables and neural model see consistent patterns.

## Open Questions
- Should we preserve original casing for proper nouns in scope?
- How to handle emoji in commit messages?

Guida per i contributori

Apri la guida per i contributori

Direzione di ricerca

Inizia con i dati grezzi di conventional commit e traccia il modo in cui i valori normalizzati alimentano le tabelle n-gram e il modello neurale. Risolvi le questioni relative a maiuscole e minuscole, spazi bianchi, caratteri, scope, nomi propri ed emoji, quindi documenta le regole in un formato automatizzabile; completato significa che ogni elemento di Success Criteria è stato affrontato.

Scritto dal modello di indicizzazione a partire dal testo della issue.

Valutazione

Stack tecnologico
python
Ambito
documentation, machine-learning
Tipo di issue
Funzionalità
Difficoltà
5/5
Tempo stimato
Più di una settimana
Stato di attività
Ferma
Chiarezza
Abbastanza chiara
Idoneità per principianti
35/100

Ricevi le nuove issue nella tua casella

Un breve riepilogo di issue GitHub adatte ai principianti.