python-jsonschema / python-jsonschema/referencing
Evaluate adding Registry.crawl(until=URI)
Dieses Issue hat noch niemand übernommen.
- Vorherrschende Sprache
- Python
- Sterne
- 53
- Forks
- 27
- Ø Merge
- 1 T. 8 Std.
- Gemergte PRs (30 T.)
- 8
Beschreibung
This is a potential performance enhancement / laziness enhancement -- we could stop crawling a registry when a particular URI of desire is found -- perhaps relatedly we could store crawled URIs in a trie or something so we go directly to the most likely location to find the resource (e.g. look in http://example.com/foo first if we're looking for http://example.com/foo/bar).
crawl(until=None) (the default) would crawl the entire set of uncrawled resources, i.e. the current behavior.
Doing this should first come with some benchmarking.
Beitragsleitfaden
Für dieses Repository ist kein Beitragsleitfaden indexiert
Erste Schritte
- Lies das ganze Issue und danach den Beitragsleitfaden des Projekts.
- Schreib ins Issue, dass du es übernimmst — das erspart doppelte Arbeit.
- Forke das Repository und arbeite in einem Branch.
- Öffne einen Pull Request, der die Issue-Nummer nennt.
Rechercherichtung
Beginne am Einstiegspunkt Registry.crawl und prüfe, wie crawl(until=None) derzeit Ressourcen verarbeitet, die noch nicht gecrawlt wurden. Lege die angeforderten Benchmarks fest, bevor du das Verhalten änderst, und bestimme anschließend, wie sich ein optionales URI-Ziel und eine trie-basierte Suche auf das Design auswirken würden. Erledigt ist die Aufgabe, wenn das Ziel das Crawlen beenden kann, sobald es gefunden wurde, während der Standard weiterhin alle noch nicht gecrawlten Ressourcen crawlt und die Benchmark-Ergebnisse aufgezeichnet werden.
Vom Indexierungsmodell aus dem Issue-Text verfasst.
Bewertung
- Tech-Stack
- python
- Bereich
- performance
- Issue-Typ
- Feature
- Schwierigkeit
- 5/5
- Geschätzter Aufwand
- Über eine Woche
- Aktivitätsstatus
- Veraltet
- Klarheit
- Größtenteils klar
- Anfängerfreundlichkeit
- 35/100