Elasticsearch(11) intervals的使用

2024-03-16 09:12

本文主要是介绍Elasticsearch(11) intervals的使用,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

elasticsearch version 7.10.1
在Elasticsearch中,intervals查询是用来做复杂的区间表达式匹配的,它可以基于分析过的文本字段执行一系列复杂的关系运算。intervals查询特别适合于那些需要对文本数据进行模式匹配,而不只是单一词汇匹配的情况。

intervals语法

POST _search
{"query": {"intervals" : {"my_text" : {"all_of" : {"ordered" : true,"intervals" : [{"match" : {"query" : "my favorite food","max_gaps" : 0,"ordered" : true}},{"any_of" : {"intervals" : [{ "match" : { "query" : "hot water" } },{ "match" : { "query" : "cold porridge" } }]}}]}}}}
}
  • intervals查询用于找到文本字段中满足一系列间隔条件的文
  • all_of子句要求所有列出的间隔条件都必须满足。
  • ordered: 设置为true,表示间隔条件必须按照指定的顺序出现。
  • intervals: 包含了一系列具体的间隔条件
  • any_of: 至少有一个列出的间隔条件必须满足

第一个间隔条件

  • 查找与"my favorite food"这个查询完全匹配的文本。
  • 设置为0,表示查询词之间不允许有任何间隔(即它们是连续的)。
  • 设置为true,再次确认查询词必须按照给定的顺序出现。

第二个间隔条件

  • 第一个match:查找与"hot water"这个查询匹配的文本
  • 第二个match:查找与"cold porridge"这个查询匹配的文本。

案例

场景一

使用intervals查询找寻句子中“quick”和“dog”之间不超过两个单词的文档

索引创建
PUT /example_index
{"mappings": {"properties": {"sentence": {"type": "text","analyzer": "standard"}}}
}
文档插入
POST /example_index/_doc
{"sentence": "The quick brown fox jumps over the lazy dog."
}POST /example_index/_doc
{"sentence": "Red roses are blue violets are red."
}POST /example_index/_doc
{"sentence": "The cat in the hat sat on the mat."
}
查询语句

场景二

使用intervals查询查找包含数字“3”到“7”的连续序列的文档

索引创建
GET /example_index/_search
{"query": {"intervals": {"sentence": {"all_of": {"intervals": [{"match": {"query": "quick"}},{"match": {"query": "dog"}}],"ordered": true,"max_gaps": 10}}}}
}
文档插入
POST /example_index_numbers/_doc
{"numbers": "1 2 3 4 5 6 7"
}POST /example_index_numbers/_doc
{"numbers": "8 9 10 11 12 13 14"
}POST /example_index_numbers/_doc
{"numbers": "15 16 17 18 19 20 21"
}
查询语句
GET /example_index_numbers/_search
{"query": {"intervals": {"numbers": {"all_of": {"intervals": [{"match": {"query": "3"}},{"match": {"query": "7"}}],"max_gaps": 3,"ordered": true}}}}
}

场景三

查询在职位描述中包含了“blue”并且紧接着是“violets”的文档。

索引创建
PUT /example_index
{"mappings": {"properties": {"content": {"type": "text","analyzer": "standard"}}}
}
文档插入
POST /example_index/_doc
{"content": "John Doe is an engineer from New York working at XYZ Corp."
}POST /example_index/_doc
{"content": "Jane Smith is a software developer based in California."
}POST /example_index/_doc
{"content": "Michael Johnson works as a data scientist at ABC Inc. in Texas."
}POST /example_index/_doc
{"content": "Sarah Brown is a product manager living in Illinois."
}POST /example_index/_doc
{"content": "Emily Davis, an architect from Washington DC, joined XYZ Corp last year."
}POST /example_index/_doc
{"content": "Robert Harris, who lives in Oregon, is a senior software engineer."
}POST /example_index/_doc
{"content": "Jessica Wilson works in marketing for ABC Inc., located in Florida."
}
查询语句
GET /example_index/_search
{"query": {"intervals": {"sentence": {"all_of": {"intervals": [{"match": {"query": "blue"}},{"match": {"query": "violets"}}],"ordered": true,"max_gaps":0}}}}
}

这篇关于Elasticsearch(11) intervals的使用的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/814998

相关文章

postgresql使用UUID函数的方法

《postgresql使用UUID函数的方法》本文给大家介绍postgresql使用UUID函数的方法,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录PostgreSQL有两种生成uuid的方法。可以先通过sql查看是否已安装扩展函数,和可以安装的扩展函数

如何使用Lombok进行spring 注入

《如何使用Lombok进行spring注入》本文介绍如何用Lombok简化Spring注入,推荐优先使用setter注入,通过注解自动生成getter/setter及构造器,减少冗余代码,提升开发效... Lombok为了开发环境简化代码,好处不用多说。spring 注入方式为2种,构造器注入和setter

MySQL中比较运算符的具体使用

《MySQL中比较运算符的具体使用》本文介绍了SQL中常用的符号类型和非符号类型运算符,符号类型运算符包括等于(=)、安全等于(=)、不等于(/!=)、大小比较(,=,,=)等,感兴趣的可以了解一下... 目录符号类型运算符1. 等于运算符=2. 安全等于运算符<=>3. 不等于运算符<>或!=4. 小于运

使用zip4j实现Java中的ZIP文件加密压缩的操作方法

《使用zip4j实现Java中的ZIP文件加密压缩的操作方法》本文介绍如何通过Maven集成zip4j1.3.2库创建带密码保护的ZIP文件,涵盖依赖配置、代码示例及加密原理,确保数据安全性,感兴趣的... 目录1. zip4j库介绍和版本1.1 zip4j库概述1.2 zip4j的版本演变1.3 zip4

Python 字典 (Dictionary)使用详解

《Python字典(Dictionary)使用详解》字典是python中最重要,最常用的数据结构之一,它提供了高效的键值对存储和查找能力,:本文主要介绍Python字典(Dictionary)... 目录字典1.基本特性2.创建字典3.访问元素4.修改字典5.删除元素6.字典遍历7.字典的高级特性默认字典

使用Python构建一个高效的日志处理系统

《使用Python构建一个高效的日志处理系统》这篇文章主要为大家详细讲解了如何使用Python开发一个专业的日志分析工具,能够自动化处理、分析和可视化各类日志文件,大幅提升运维效率,需要的可以了解下... 目录环境准备工具功能概述完整代码实现代码深度解析1. 类设计与初始化2. 日志解析核心逻辑3. 文件处

一文详解如何使用Java获取PDF页面信息

《一文详解如何使用Java获取PDF页面信息》了解PDF页面属性是我们在处理文档、内容提取、打印设置或页面重组等任务时不可或缺的一环,下面我们就来看看如何使用Java语言获取这些信息吧... 目录引言一、安装和引入PDF处理库引入依赖二、获取 PDF 页数三、获取页面尺寸(宽高)四、获取页面旋转角度五、判断

C++中assign函数的使用

《C++中assign函数的使用》在C++标准模板库中,std::list等容器都提供了assign成员函数,它比操作符更灵活,支持多种初始化方式,下面就来介绍一下assign的用法,具有一定的参考价... 目录​1.assign的基本功能​​语法​2. 具体用法示例​​​(1) 填充n个相同值​​(2)

Spring StateMachine实现状态机使用示例详解

《SpringStateMachine实现状态机使用示例详解》本文介绍SpringStateMachine实现状态机的步骤,包括依赖导入、枚举定义、状态转移规则配置、上下文管理及服务调用示例,重点解... 目录什么是状态机使用示例什么是状态机状态机是计算机科学中的​​核心建模工具​​,用于描述对象在其生命

使用Python删除Excel中的行列和单元格示例详解

《使用Python删除Excel中的行列和单元格示例详解》在处理Excel数据时,删除不需要的行、列或单元格是一项常见且必要的操作,本文将使用Python脚本实现对Excel表格的高效自动化处理,感兴... 目录开发环境准备使用 python 删除 Excphpel 表格中的行删除特定行删除空白行删除含指定