2024-01-25(ElasticSearch)

附上:ElasticSearch从入门到精通,史上最全(持续更新,未完待续,每天一点点)_elasticsearch从入门到精通,史上最全-CSDN博客

1.ES中存储不是重要的,搜索查询功能才是ES的核心

2.ES提供了基于JSON的DSL(Domain Specific Language)来定义查询。

常见的查询类型:查询所有,全文索引,精确查询,地理查询,复合查询。

3.精确查询的值是不可分割的整体,所以可以采用精确查询来做。

4.ES是分布式的,并且会将数据切分开的存储到不同的服务器上。所以ES会面临深度分页问题。

5.ES还可以把搜索结果高亮显示。例如百度搜索Java,Java关键字会红色显示。

原理:服务端将搜索结果中的关键字用标签标记出来,然后在页面中给标签添加CSS样式。

6.ES中的数据聚合:

聚合可以实现对文档数据的统计,分析,运算,聚合常见有三类:

桶聚合:用来对文档做分组

度量聚合:用来计算一些值,比如最大值,最小值,平均值等

管道聚合:其他聚合的结果为基础做聚合

7.技术都是根据需求来的,业务场景的使用推动技术的发展。业务高于技术。技术为业务服务。

8.ES中的分词器,包含三个部分:

character filters:在tokenizer之前对文本进行处理。例如删除字符,替换字符

tokenizer:将文本按照一定的规则切割成词条。

tokenizer filter:将tokenizer输出的词条做进一步处理。例如大小写转换,同义词处理,拼音处理等。

9.ES实现自动补全功能的查询

自动补全对字段的要求:类型是completion类型,字段值是多词条的数组

10.ES && MySQL 对比:

ES中的index索引库就类似于MySQL中的数据库。

ES中的Type类型就类似于MySQL中对于表的定义。

ES中的document文档就是最终存储数据的地方,类似于MySQL中表的一条数据。

ES中的Field字段类似于MySQL中的列的概念。

ES中的shard分片:一台服务器,无法存储大量的数据,ES把一个index里面的数据,分为多个shard,分布式的存储在各个服务器上面。

相关推荐
jkyy20141 分钟前
食材图像识别与个性化饮食:智能家电如何重构膳食健康管理?
大数据·人工智能·物联网·健康医疗
jiaozi_zzq19 分钟前
2026 高职财务专业就业方向与进阶指南
大数据·数据分析·证书·财务
Elasticsearch1 小时前
Jina Code Embeddings:0.5B 和 1.5B 的 SOTA 代码检索
elasticsearch
roman_日积跬步-终至千里1 小时前
【大数据架构:架构思想基础】Google三篇论文开启大数据处理序章:(数据存储)分布式架构、(数据计算)并行计算、(数据管理)分片存储
大数据·分布式·架构
Elasticsearch1 小时前
Jina Reranker v3:用于 SOTA 多语言 检索 的 0.6B 列表式 重排序器
elasticsearch
CHrisFC2 小时前
中小型第三方环境检测实验室的数字化破局之选——江苏硕晟LIMS
大数据·运维·人工智能
小北方城市网2 小时前
GEO 智变新篇:质效双升 + 责任共生,打造 AI 时代本地商业长效增长引擎
大数据·人工智能·python·数据库架构
神算大模型APi--天枢6462 小时前
自主算力筑基,垂域模型破局:国产硬件架构下的行业大模型训练与微调服务实践
大数据·人工智能·科技·架构·硬件架构
2501_940975802 小时前
AI降重:当学术写作遇上智能算法,如何守住原创底线?
大数据·人工智能
AC赳赳老秦3 小时前
基于DeepSeek与接口文档的智能测试数据生成实践
数据库·elasticsearch·信息可视化·流程图·数据库架构·powerbi·deepseek