Nemo

Nemo 关注TA

路漫漫其修远兮,吾将上下而求索。

Nemo

Nemo

关注TA

路漫漫其修远兮,吾将上下而求索。

  • 加入社区3,288天
  • 写了1,496,113字

标签 > 标签文章:#全文检索# (共有7文章)

  • Elasticsearch 配置IK分词器

    Elasticsearch 配置IK分词器
    前因:众所周知,Es内置的分词器对于中文并不是那么的友好,它会将中文分割成单个字,而不是一块词组,并不能达到分词检索效果。如使用默认分词器分词:$curl-XPOSThttp://127.0.0.1:9200/_analyze?pretty-H'Content-Type:application/json;chartset=UTF-8'-d'{"analyzer":"sdandard","text"

     1,369    1    2020-05-14 14:59

  • Elasticsearch 可视化管理工具 ElasticHD

    Elasticsearch 可视化管理工具 ElasticHD
    先上图:看样子很强大的样子,在试用中。项目地址:https://github.com/360EntSecGroup-Skylar/ElasticHDwindows下安装使用:1、下载并解压。2、执行ElasticHD.exe。3、打开浏览器访问http://127.0.0.1:9800/。

     1,587    0    2020-05-14 13:57

  • Elasticsearch 字段映射

    Elasticsearch 字段映射
    一般来说,主要有两种映射方式:1、动态映射:写入时,es根据字段类型识别。2、静态映射:写入时,手动指定字段类型。动态映射:自动映射类型规则如下:null->没有字段被添加trueorfalse->boolean类型浮点类型数字->float类型数字->long类型JSON对象->object对象数组->由数组里第一个非空值决定string->有可能是da

     1,466    0    2020-05-14 10:42

  • Luncene 特殊字符查询处理

    参考solr的处理方式:/***See:{@linkorg.apache.lucene.queryparser.classicqueryparsersyntax}*formoreinformationonEscapingSpecialCharacters*/publicstaticStringescapeQueryChars(Strings){StringBuildersb=newStringBu......

     2,765    0    2017-10-20 18:36

  • Luncene 多字段查询记录

    多字段查询需要使用MultiFieldQueryParser来做解析:Stringparams[]=newString[]{par,par};Stringfields[]=newString[]{"title","context"};BooleanClause.Occurrules[]=newBooleanClause.Occur[]{BooleanClause.Occur.SHOULD,Bool......

     3,631    0    2017-10-18 14:27

  • Lucene 创建全文检索基本原理记录

    Lucene 创建全文检索基本原理记录
    基本过程有两部分:索引和搜索。1.索引过程:1)有一系列被索引文件2)被索引文件经过语法分析和语言处理形成一系列词(Term)。3)经过索引创建形成词典和反向索引表。4)通过索引存储将索引写入硬盘。2.搜索过程:a)用户输入查询语句。b)对查询语句经过语法分析和语言分析得到一系列词(Term)。c)通过语法分析得到一个查询树。d)通过索引存储将索引读入到内存。e)利用查询树搜索索引,从而得到每个词......

     4,630    0    2017-09-21 09:56

  • Lucene入门样例 - 第一个demo

    这两天正好有点空闲,稍稍看了一些lucene的内容。晚点可能会在link-nemo上加入相关的使用。这里先记录一个最简单的样例代码。Lucene是apache基金会里头比较有名的一个项目了,之前用过基于它的另一个全文检索框架Solr。需要的依赖jar:<groupId>org.apache.lucenegroupId>lucene-core</artifactId>5......

     3,497    2    2017-09-20 18:34

  • 1