apache / apache/answer

Quality improvment of Similar question Feature

Abierto
#767 2 comentarios 0 reacciones 0 asignados Ver en GitHub
enhancement
Lenguaje dominante
Go
Estrellas
15.7k
Forks
1.4k
Merge medio
3 d 8 h
PR fusionados (30 d)
7

Descripción

## Is your enhancement request related to a problem? Please describe
Right now it looks query condition is like '%Input_string%' this is only good first to start.
I have testing this on meta.answer.dev

## Describe the solution you'd like
Use tokenizer (quite common in Nlp) which split input text into small words (sometimes sub words) and lookup tokens in database for finding similar question

## Describe alternatives you've considered

A clear and concise description of any alternative solutions or features you've considered.

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Línea de trabajo

No se especifican archivos ni pruebas. Empieza por localizar la implementación de preguntas similares y su consulta actual a la base de datos; después, estudia cómo se almacena y se busca el texto de las preguntas. Se considerará terminado cuando exista un enfoque de matching basado en tokenizer, definido y revisado, con evidencias de que mejora los resultados de preguntas similares frente a la búsqueda actual por subcadenas.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
go
Área
backend, search
Tipo de issue
Nueva funcionalidad
Dificultad
5/5
Tiempo estimado
Más de una semana
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
25/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.