bigscience-workshop / bigscience-workshop/pii_processing

save right and wrong file in test_regex.py and improve accuracy stats

Offen
#3 0 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
Vorherrschende Sprache
Python
Sterne
9
Forks
6
PR-Merge-Kennzahlen
Keine gemergten PRs in 30 T.

Beschreibung

Save away the "right" and "wrong" variables returned in test_regex.py in a json file. Also, tie back the rule_id/rule_group numbers back to the original regex. Print some stats, by rule_id, rule_group and overall regex.

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Rechercherichtung

Beginne damit, test_regex.py zu lesen und auszuführen, um nachzuverfolgen, wie die Variablen right und wrong, rule_id, rule_group und der ursprüngliche regex erzeugt werden. Erledigt ist dies, wenn die Ergebnisse in JSON gespeichert werden, die Regel-IDs weiterhin ihren Quell-regexes zugeordnet sind und Statistiken pro rule_id, pro rule_group und insgesamt ausgegeben werden.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
python
Bereich
data, security
Issue-Typ
Feature
Schwierigkeit
3/5
Geschätzter Aufwand
1-2 Tage
Aktivitätsstatus
Veraltet
Klarheit
Größtenteils klar
Anfängerfreundlichkeit
42/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.