jiebaR 中文分词

jiebaR 中文分词

Linux : Build Status Mac : Build Status Win : Build status

"结巴"中文分词的R语言版本,支持最大概率法(Maximum Probability),隐式马尔科夫模型(Hidden Markov Model),索引模型(QuerySegment),混合模型(MixSegment),共四种分词模式,同时有词性标注,关键词提取,文本Simhash相似度比较等功能。项目使用了RcppCppJieba进行开发。

使用中遇到的任何问题,都可以: