hankcs / hankcs/MainPartExtractor

一些看法

Open
#2 0 comments 0 reactions 0 assignees View on GitHub
Dominant language
Java
Stars
140
Forks
84
PR merge metrics
No merged PRs in 30d

Description

刚找到你的项目,感觉还是挺厉害,膜拜一下!
我在想,在文本分类中大多都是分词然后提取关键特征去计算概率去分类。但是就是分词的时候很麻烦,在不同领域中,常用的中文分词却是差强人意。。。但是可以基于你的提取每一句的主干(或者说中心大意),然后再分词,计算。感觉准确率,还有计算量可能也会小点。。。个人还是比较看好的。感谢作者的开源

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.