Linux-CentOS Elasticsearch 安装ik中文分词

时间:2022-11-09 10:02:04

      Elasticsearch中,内置了很多分词器(analyzers),例如standard (标准分词器)、english (英文分词)和chinese (中文分词)。其中standard 就是无脑的一个一个词(汉字)切分,所以适用范围广,但是精准度低;english 对英文更加智能,可以识别单数负数,大小写,过滤stopwords(例如“the”这个词)等;chinese 效果很差。


源代码地址:https://github.com/medcl/elasticsearch-analysis-ik

安装说明很详细。

      如果上面的mvn搞不定的话,你可以直接从 elasticsearch-rtf 项目中找到编译好的jar包和配置文件(我就是怎么干的)。

https://github.com/medcl/elasticsearch-rtf

1. 将jar包plugins/elasticsearch-analysis-ik-1.6.0复制到Elasticsearch的plugins/analysis-ik目录下,再把解压出的ik目录config/ik(配置和词典等),复制到Elasticsearch的config 目录下。

2. 编辑配置文件elasticsearch.yml ,在后面加一行:

index.analysis.analyzer.ik.type : "ik" 
Linux-CentOS Elasticsearch 安装ik中文分词