Nemo

关注TA

路漫漫其修远兮，吾将上下而求索。

加入社区3,288天
写了1,496,113字

标签 > 标签文章：#全文检索# (共有7文章)

Elasticsearch 配置IK分词器

前因：众所周知，Es内置的分词器对于中文并不是那么的友好，它会将中文分割成单个字，而不是一块词组，并不能达到分词检索效果。如使用默认分词器分词：$curl-XPOSThttp://127.0.0.1:9200/_analyze?pretty-H'Content-Type:application/json;chartset=UTF-8'-d'{"analyzer":"sdandard","text"

1,369 1 2020-05-14 14:59
Elasticsearch 可视化管理工具 ElasticHD

先上图：看样子很强大的样子，在试用中。项目地址：https://github.com/360EntSecGroup-Skylar/ElasticHDwindows下安装使用：1、下载并解压。2、执行ElasticHD.exe。3、打开浏览器访问http://127.0.0.1:9800/。

1,587 0 2020-05-14 13:57
Elasticsearch 字段映射

一般来说，主要有两种映射方式：1、动态映射：写入时，es根据字段类型识别。2、静态映射：写入时，手动指定字段类型。动态映射：自动映射类型规则如下：null->没有字段被添加trueorfalse->boolean类型浮点类型数字->float类型数字->long类型JSON对象->object对象数组->由数组里第一个非空值决定string->有可能是da

1,466 0 2020-05-14 10:42
Luncene 特殊字符查询处理

参考solr的处理方式：/***See:{@linkorg.apache.lucene.queryparser.classicqueryparsersyntax}*formoreinformationonEscapingSpecialCharacters*/publicstaticStringescapeQueryChars(Strings){StringBuildersb=newStringBu......

2,765 0 2017-10-20 18:36
Luncene 多字段查询记录

多字段查询需要使用MultiFieldQueryParser来做解析：Stringparams[]=newString[]{par,par};Stringfields[]=newString[]{"title","context"};BooleanClause.Occurrules[]=newBooleanClause.Occur[]{BooleanClause.Occur.SHOULD,Bool......

3,631 0 2017-10-18 14:27
Lucene 创建全文检索基本原理记录

基本过程有两部分：索引和搜索。1.索引过程：1)有一系列被索引文件2)被索引文件经过语法分析和语言处理形成一系列词(Term)。3)经过索引创建形成词典和反向索引表。4)通过索引存储将索引写入硬盘。2.搜索过程：a)用户输入查询语句。b)对查询语句经过语法分析和语言分析得到一系列词(Term)。c)通过语法分析得到一个查询树。d)通过索引存储将索引读入到内存。e)利用查询树搜索索引，从而得到每个词......

4,630 0 2017-09-21 09:56
Lucene入门样例 - 第一个demo

这两天正好有点空闲，稍稍看了一些lucene的内容。晚点可能会在link-nemo上加入相关的使用。这里先记录一个最简单的样例代码。Lucene是apache基金会里头比较有名的一个项目了，之前用过基于它的另一个全文检索框架Solr。需要的依赖jar：<groupId>org.apache.lucenegroupId>lucene-core</artifactId>5......

3,497 2 2017-09-20 18:34

Nemo

Elasticsearch 配置IK分词器

Elasticsearch 可视化管理工具 ElasticHD

Elasticsearch 字段映射

Luncene 特殊字符查询处理

Luncene 多字段查询记录

Lucene 创建全文检索基本原理记录

Lucene入门样例 - 第一个demo