Chinaunix首页 | 论坛 | 博客
  • 博客访问: 4456422
  • 博文数量: 1214
  • 博客积分: 13195
  • 博客等级: 上将
  • 技术积分: 9105
  • 用 户 组: 普通用户
  • 注册时间: 2007-01-19 14:41
个人简介

C++,python,热爱算法和机器学习

文章分类

全部博文(1214)

文章存档

2021年(13)

2020年(49)

2019年(14)

2018年(27)

2017年(69)

2016年(100)

2015年(106)

2014年(240)

2013年(5)

2012年(193)

2011年(155)

2010年(93)

2009年(62)

2008年(51)

2007年(37)

分类: 服务器与存储

2016-11-03 16:41:51

原文地址:

搜索引擎的自动补全,本文基于搜索历史进行补全,适用于拥有大量数据的搜索引擎。在ElasticSearch中可以使用Completion Suggester实现。

f72f4f73aee3098f67c04e661ebd459f-original.png


首先创建基于ik插件的自动补全mapping:

curl -XPOST  -d'
{
  "suggest": {
    "properties": {
      "tag": {
        "type": "string",
        "analyzer": "ik",
        "search_analyzer": "ik"
      },
      "tag_suggest": {
        "type": "completion",
        "analyzer": "ik",
        "search_analyzer": "ik",
        "payloads": false
      }
    }
  }
}'

插入测试数据:

curl -XPUT "" -d'{
    "tag":["梭织","蕾丝","汗布","针织","毛呢"],
    "tag_suggest":{
        "input":["梭织","蕾丝","汗布","针织","毛呢"]
    }
}'

curl -XPUT "" -d'{
    "tag":["绒布","牛仔布","罗纹","网眼","平板布"],
    "tag_suggest":{
        "input":["绒布","牛仔布","罗纹","网眼","平板布"]
    }
}'
curl -XPUT "" -d'{
    "tag":["蕾丝布","蕾丝网"],
    "tag_suggest":{
        "input":["蕾丝布","蕾丝网"]
    }
}'

最后通过_suggest对Completion Suggester数据进行搜索:

curl -XPOST "" -d'
{
    "suggest-suggest": {
    "text": "蕾丝",
    "completion": {
      "field": "tag_suggest",
      "size": 10 //返回结果数量
      }
    }
}'

其中suggest-suggest中第一个suggest代表当前索引文档的type,^_^,比较懒,不想改type名了。

如果结果返回:

{
  "_shards": {
    "total": 5,
    "successful": 5,
    "failed": 0
  },
  "suggest_suggest": [
    {
      "text": "蕾丝",
      "offset": 0,
      "length": 2,
      "options": [
        {
          "text": "蕾丝",
          "score": 1
        },
        {
          "text": "蕾丝布",
          "score": 1
        },
        {
          "text": "蕾丝网",
          "score": 1
        }
      ]
    }
  ]
}

恭喜你,自动补全功能即已实现。

阅读(9737) | 评论(0) | 转发(0) |
给主人留下些什么吧!~~