-
Elasticsearch 配置IK分词器
前因:众所周知,Es内置的分词器对于中文并不是那么的友好,它会将中文分割成单个字,而不是一块词组,并不能达到分词检索效果。如使用默认分词器分词:$curl-XPOSThttp://127.0.0.1:9200/_analyze?pretty-H'Content-Type:application/json;chartset=UTF-8'-d'{"analyzer":"sdandard","text"1,369 1 2020-05-14 14:59
-
Elasticsearch 可视化管理工具 ElasticHD
先上图:看样子很强大的样子,在试用中。项目地址:https://github.com/360EntSecGroup-Skylar/ElasticHDwindows下安装使用:1、下载并解压。2、执行ElasticHD.exe。3、打开浏览器访问http://127.0.0.1:9800/。1,587 0 2020-05-14 13:57
-
Elasticsearch 字段映射
一般来说,主要有两种映射方式:1、动态映射:写入时,es根据字段类型识别。2、静态映射:写入时,手动指定字段类型。动态映射:自动映射类型规则如下:null->没有字段被添加trueorfalse->boolean类型浮点类型数字->float类型数字->long类型JSON对象->object对象数组->由数组里第一个非空值决定string->有可能是da1,466 0 2020-05-14 10:42
-
Luncene 特殊字符查询处理
参考solr的处理方式:/***See:{@linkorg.apache.lucene.queryparser.classicqueryparsersyntax}*formoreinformationonEscapingSpecialCharacters*/publicstaticStringescapeQueryChars(Strings){StringBuildersb=newStringBu......2,765 0 2017-10-20 18:36
-
Luncene 多字段查询记录
多字段查询需要使用MultiFieldQueryParser来做解析:Stringparams[]=newString[]{par,par};Stringfields[]=newString[]{"title","context"};BooleanClause.Occurrules[]=newBooleanClause.Occur[]{BooleanClause.Occur.SHOULD,Bool......3,631 0 2017-10-18 14:27
-
Lucene 创建全文检索基本原理记录
基本过程有两部分:索引和搜索。1.索引过程:1)有一系列被索引文件2)被索引文件经过语法分析和语言处理形成一系列词(Term)。3)经过索引创建形成词典和反向索引表。4)通过索引存储将索引写入硬盘。2.搜索过程:a)用户输入查询语句。b)对查询语句经过语法分析和语言分析得到一系列词(Term)。c)通过语法分析得到一个查询树。d)通过索引存储将索引读入到内存。e)利用查询树搜索索引,从而得到每个词......4,630 0 2017-09-21 09:56
-
Lucene入门样例 - 第一个demo
这两天正好有点空闲,稍稍看了一些lucene的内容。晚点可能会在link-nemo上加入相关的使用。这里先记录一个最简单的样例代码。Lucene是apache基金会里头比较有名的一个项目了,之前用过基于它的另一个全文检索框架Solr。需要的依赖jar:<groupId>org.apache.lucenegroupId>lucene-core</artifactId>5......3,497 2 2017-09-20 18:34