ictclas,ansj,結巴分詞,StanfordNLP中文分詞以及所用詞性標注集


NLPIR(ICTCLAS),參見java實現NLPIR(ICTCLAS)分詞:http://www.bubuko.com/infodetail-665665.html,詞性標注使用北大詞性標注集。在Linux系統中的使用方法:http://jingyan.baidu.com/article/9158e0004251b4a2541228e5.html

ansj分詞,非常好用,ansj-seg把分詞、詞性標注、新詞發現、關鍵詞提取這些功能的接口,都抽取出來了,方便我們選擇其中一部分使用,這點尤其在處理大數據量的時候至關重要。使用新版的北大詞性標注集,略有不同。ansj的源碼地

址:http://nlpchina.github.io/ansj_seg/。ansj分詞器的配置:http://blog.csdn.net/zhongkeli/article/details/17722065(可直接在eclipse中使用)。

StanfordNLP中文分詞使用CTB(Chinese Tree Bank)中文樹庫標注詞性;結巴分詞用北大詞性標注集

 


免責聲明!

本站轉載的文章為個人學習借鑒使用,本站對版權不負任何法律責任。如果侵犯了您的隱私權益,請聯系本站郵箱yoyou2525@163.com刪除。



 
粵ICP備18138465號   © 2018-2025 CODEPRJ.COM