hankcs / hankcs/MainPartExtractor
一些看法
- Ngôn ngữ chính
- Java
- Star
- 140
- Fork
- 84
- Chỉ số merge pull request
- Không có pull request nào được merge trong 30 ngày
Mô tả
刚找到你的项目,感觉还是挺厉害,膜拜一下!
我在想,在文本分类中大多都是分词然后提取关键特征去计算概率去分类。但是就是分词的时候很麻烦,在不同领域中,常用的中文分词却是差强人意。。。但是可以基于你的提取每一句的主干(或者说中心大意),然后再分词,计算。感觉准确率,还有计算量可能也会小点。。。个人还是比较看好的。感谢作者的开源
Hướng dẫn đóng góp
Chưa lập chỉ mục được hướng dẫn đóng góp cho kho mã nguồn này
Hướng nghiên cứu
Issue này chứa những lời khen chung chung và một đề xuất về việc trích xuất cấu trúc câu trước khi phân đoạn từ tiếng Trung để phân loại văn bản. Không có tệp, bài kiểm thử, điểm truy cập hay tiêu chí chấp nhận cụ thể nào được nêu; hãy bắt đầu bằng cách xem xét triển khai hiện có của dự án và xác định liệu ý tưởng này có phạm vi khả thi hay không. Chỉ dựa vào issue thì không thể xác định rõ công việc đã hoàn tất.
Do mô hình lập chỉ mục viết ra từ nội dung của issue.
Đánh giá
- Công nghệ
- java
- Lĩnh vực
- machine-learning
- Loại issue
- Tính năng
- Độ khó
- 5/5
- Thời gian dự kiến
- Hơn một tuần
- Mức độ hoạt động
- Đình trệ
- Độ rõ ràng
- Cần làm rõ
- Mức phù hợp với người mới
- 10/100