【開源中文分詞工具探析】系列:

  1. 中文分詞工具探析(一):ICTCLAS (NLPIR)

  2. 中文分詞工具探析(二):Jieba

  3. 中文分詞工具探析(三):Ansj

  4. 開源中文分詞工具探析(四):THULAC

  5. 開源中文分詞工具探析(五):FNLP


1. 前言

Jieba是由fxsjy大神開源的一款中文分詞工具,一款屬于工業(yè)界的分詞工具——模型易用簡單、代碼清晰可讀,推薦有志學習NLP或Python的讀一下源碼。與采用分詞模型Bigram + HMM 的ICTCLAS 相類似,Jieba采用的是Unigram + HMM。

延伸閱讀

學習是年輕人改變自己的最好方式-Java培訓,做最負責任的教育,學習改變命運,軟件學習,再就業(yè),大學生如何就業(yè),幫大學生找到好工作,lphotoshop培訓,電腦培訓,電腦維修培訓,移動軟件開發(fā)培訓,網站設計培訓,網站建設培訓學習是年輕人改變自己的最好方式