ictclas,ansj,结巴分词,StanfordNLP中文分词以及所用词性标注集
生活随笔
收集整理的這篇文章主要介紹了
ictclas,ansj,结巴分词,StanfordNLP中文分词以及所用词性标注集
小編覺得挺不錯的,現在分享給大家,幫大家做個參考.
NLPIR(ICTCLAS),參見java實現NLPIR(ICTCLAS)分詞:http://www.bubuko.com/infodetail-665665.html,詞性標注使用北大詞性標注集。在Linux系統中的使用方法:http://jingyan.baidu.com/article/9158e0004251b4a2541228e5.html
ansj分詞,非常好用,ansj-seg把分詞、詞性標注、新詞發現、關鍵詞提取這些功能的接口,都抽取出來了,方便我們選擇其中一部分使用,這點尤其在處理大數據量的時候至關重要。使用新版的北大詞性標注集,略有不同。ansj的源碼地
址:http://nlpchina.github.io/ansj_seg/。ansj分詞器的配置:http://blog.csdn.net/zhongkeli/article/details/17722065(可直接在eclipse中使用)。
StanfordNLP中文分詞使用CTB(Chinese Tree Bank)中文樹庫標注詞性;結巴分詞用北大詞性標注集
總結
以上是生活随笔為你收集整理的ictclas,ansj,结巴分词,StanfordNLP中文分词以及所用词性标注集的全部內容,希望文章能夠幫你解決所遇到的問題。
- 上一篇: 不可不看的Java基础知识整理,注释、关
- 下一篇: MetaGPT day01: Meta