Use Unicode Properties in regex normalization license expressions
Dieses Issue hat noch niemand übernommen.
- Vorherrschende Sprache
- Java
- Sterne
- 71
- Forks
- 44
- Ø Merge
- 12 Std. 54 Min.
- Gemergte PRs (30 T.)
- 7
Beschreibung
From the discussion on implementers call on 29 Oct., we could use Unicode properties in the regular expressions to simplify and possible speed up the license matching algorithms.
Reference: https://en.wikipedia.org/wiki/Unicode_character_property
Beitragsleitfaden
Erste Schritte
- Lies das ganze Issue und danach den Beitragsleitfaden des Projekts.
- Schreib ins Issue, dass du es übernimmst — das erspart doppelte Arbeit.
- Forke das Repository und arbeite in einem Branch.
- Öffne einen Pull Request, der die Issue-Nummer nennt.
Rechercherichtung
Beginne damit, die Algorithmen zur Normalisierung und zum Abgleich von Lizenz-Ausdrücken zu lokalisieren, und sieh dir anschließend die im Issue verlinkte Referenz zu Unicode-Zeicheneigenschaften an. Vergleiche die vorhandenen regulären Ausdrücke mit dem vorgeschlagenen Unicode-Property-Ansatz und stelle fest, welche Vereinfachung oder Leistungsverbesserung zu erwarten ist, bevor du die Implementierung änderst.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- java
- Bereich
- backend
- Issue-Typ
- Refactoring
- Schwierigkeit
- 4/5
- Geschätzter Aufwand
- 3-5 Tage
- Aktivitätsstatus
- Veraltet
- Klarheit
- Muss geklärt werden
- Anfängerfreundlichkeit
- 35/100