NLPIR(ICTCLAS),參見java實現NLPIR(ICTCLAS)分詞:http://www.bubuko.com/infodetail-665665.html,詞性標注使用北大詞性標注集。在Linux系統中的使用方法:http://jingyan.baidu.com/article/9158e0004251b4a2541228e5.html
ansj分詞,非常好用,ansj-seg把分詞、詞性標注、新詞發現、關鍵詞提取這些功能的接口,都抽取出來了,方便我們選擇其中一部分使用,這點尤其在處理大數據量的時候至關重要。使用新版的北大詞性標注集,略有不同。ansj的源碼地
址:http://nlpchina.github.io/ansj_seg/。ansj分詞器的配置:http://blog.csdn.net/zhongkeli/article/details/17722065(可直接在eclipse中使用)。
StanfordNLP中文分詞使用CTB(Chinese Tree Bank)中文樹庫標注詞性;結巴分詞用北大詞性標注集