hankcs / hankcs/MainPartExtractor

一些看法

Abierto
#2 0 comentarios 0 reacciones 0 asignados Ver en GitHub
Lenguaje dominante
Java
Estrellas
140
Forks
84
Métricas de merge de PR
Sin PR fusionados en 30 d

Descripción

刚找到你的项目,感觉还是挺厉害,膜拜一下!
我在想,在文本分类中大多都是分词然后提取关键特征去计算概率去分类。但是就是分词的时候很麻烦,在不同领域中,常用的中文分词却是差强人意。。。但是可以基于你的提取每一句的主干(或者说中心大意),然后再分词,计算。感觉准确率,还有计算量可能也会小点。。。个人还是比较看好的。感谢作者的开源

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Línea de trabajo

The issue contains general praise and a suggestion about extracting sentence structure before Chinese word segmentation for text classification. No files, tests, entry points, or concrete acceptance criteria are named; start by reviewing the project's existing implementation and determine whether this idea has an actionable scope. The work is not clearly done from the issue alone.

Escrito por el modelo de indexación a partir del texto del issue.

Evaluación

Stack tecnológico
java
Área
machine-learning
Tipo de issue
Nueva funcionalidad
Dificultad
5/5
Tiempo estimado
Más de una semana
Estado de actividad
Estancado
Claridad
Necesita aclaración
Aptitud para principiantes
10/100

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.