curran / curran/google-diff-match-patch
Uppercase letter boundary in semantic cleanup
- Vorherrschende Sprache
- Python
- Sterne
- 17
- Forks
- 2
- PR-Merge-Kennzahlen
- Keine gemergten PRs in 30 T.
Beschreibung
```
Adding an "uppercase letter boundary" to semantic cleanup score will make code
diffs look nicer.
For example,
cleanupSemanticScore
would be changed to
cleanupSemanticScore
This might be useful in regular texts too (e.g. with people's names -
M[cM]illan => [Mc]Millan)
The change seems to be easy and straightforward:
private int diff_cleanupSemanticScore(String one, String two) {
...
boolean uppercase1 = Character.isUpperCase(char1);
boolean uppercase2 = Character.isUpperCase(char2);
...
else if (!uppercase1 && uppercase2) {
// One point for upper case.
return 1;
}
return 0;
}
```
Original issue reported on code.google.com by `2sa...@gmail.com` on 13 Jun 2012 at 5:00
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Rechercherichtung
Beginne damit, die Implementierung von diff_cleanupSemanticScore zu finden und die umgebende Logik der semantischen Bereinigung zu lesen; das Issue enthält die vorgeschlagenen Prüfungen für Großbuchstabengrenzen und Beispieltransformationen. Bestätige die Änderung mit der vorhandenen Testsuite des Repositorys und überprüfe, dass die Bereinigung die angeforderte Diff-Formulierung erzeugt, ohne die Verarbeitung von normalem Text zu beeinträchtigen.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- java, python
- Bereich
- tooling
- Issue-Typ
- Feature
- Schwierigkeit
- 2/5
- Geschätzter Aufwand
- 1-3 Stunden
- Aktivitätsstatus
- Veraltet
- Klarheit
- Klar beschrieben
- Anfängerfreundlichkeit
- 45/100