hankcs / hankcs/MainPartExtractor
一些看法
Open
- Dominant language
- Java
- Stars
- 140
- Forks
- 84
- PR merge metrics
- No merged PRs in 30d
Description
刚找到你的项目,感觉还是挺厉害,膜拜一下!
我在想,在文本分类中大多都是分词然后提取关键特征去计算概率去分类。但是就是分词的时候很麻烦,在不同领域中,常用的中文分词却是差强人意。。。但是可以基于你的提取每一句的主干(或者说中心大意),然后再分词,计算。感觉准确率,还有计算量可能也会小点。。。个人还是比较看好的。感谢作者的开源
Contributor guide
No contributing guide indexed for this repository
Assessment
This issue has not been assessed yet.