apache / apache/answer

Quality improvment of Similar question Feature

Offen
#767 2 Kommentare 0 Reaktionen 0 zugewiesene Personen Auf GitHub ansehen
enhancement
Vorherrschende Sprache
Go
Sterne
15.7k
Forks
1.4k
Ø Merge
3 T. 8 Std.
Gemergte PRs (30 T.)
7

Beschreibung

## Is your enhancement request related to a problem? Please describe
Right now it looks query condition is like '%Input_string%' this is only good first to start.
I have testing this on meta.answer.dev

## Describe the solution you'd like
Use tokenizer (quite common in Nlp) which split input text into small words (sometimes sub words) and lookup tokens in database for finding similar question

## Describe alternatives you've considered

A clear and concise description of any alternative solutions or features you've considered.

Beitragsleitfaden

Für dieses Repository ist kein Beitragsleitfaden indexiert

Rechercherichtung

Es werden keine Dateien oder Tests genannt. Beginne damit, die Implementierung für ähnliche Fragen und ihre aktuelle Datenbankabfrage zu finden, und untersuche anschließend, wie Fragentext gespeichert und durchsucht wird. Als abgeschlossen gilt eine definierte, geprüfte Matching-Strategie auf Tokenizer-Basis mit Nachweisen dafür, dass sie die Ergebnisse ähnlicher Fragen gegenüber der aktuellen Teilstring-Suche verbessert.

Vom Indexierungsmodell aus dem Issue-Text verfasst.

Bewertung

Tech-Stack
go
Bereich
backend, search
Issue-Typ
Feature
Schwierigkeit
5/5
Geschätzter Aufwand
Über eine Woche
Aktivitätsstatus
Veraltet
Klarheit
Muss geklärt werden
Anfängerfreundlichkeit
25/100

Neue Issues direkt in Ihr Postfach

Eine kurze Übersicht über anfängerfreundliche GitHub-Issues.