Semantic_text 字段默认嵌入模型变为 .jina-embeddings-v5-text-small

在早期的 Elastic Stack 版本(9.4 之前),当我们定义 semantic_text 字段时,没有指名它的 inference endpoint,那么它的默认 inference endpoint 就是 .elser_model_2。从 Elastic Stack 9.4 之后,我们可以看到这个变化。比如:

bash 复制代码
`

1.  PUT semantic_text
2.  {
3.    "mappings": {
4.      "properties": {
5.        "content": {
6.          "type": "text",
7.          "copy_to": "inference_field"
8.        },
9.        "inference_field": {
10.          "type": "semantic_text"
11.        }
12.      }
13.    }
14.  }

`AI写代码![](https://csdnimg.cn/release/blogv2/dist/pc/img/runCode/icon-arrowwhite.png)

如上所示,我们定以了一个叫做 content 的字段,它的类型是 text。我们同时也把它拷贝到 inference_field 字段,而它的类型是 semantic_text。在上面,我们并没有标注它的 inference id。那么在默认的情况下,它的 inference id 是什么呢?

我们可以打入如下的命令:

bash 复制代码
`GET semantic_text/_mapping` AI写代码

我们可以看到在默认的情况下,它的 inference_id 是 .jina-embeddings-v5-text-small,也就是说它支持上百种语音。

我们做一个简单的例子:

css 复制代码
`

1.  PUT semantic_text/_bulk
2.  {"index": {"_id": "1"}}
3.  {"content": "阿里巴巴(中国)有限公司成立于2007年03月26日,法定代表人蒋芳"}
4.  {"index": {"_id": "2"}}
5.  {"content": "百度是拥有强大互联网基础的领先AI公司。百度愿景是:成为最懂用户,并能帮助人们成长的全球顶级高科技公司。于2000年1月1日在中关村创建了百度公司"}

`AI写代码

我们写入上面的文档,并做如下的查询:

bash 复制代码
`

1.  GET semantic_text/_search
2.  {
3.    "query": {
4.      "match": {
5.        "inference_field": "阿里是什么样的公司?"
6.      }
7.    }
8.  }

`AI写代码
bash 复制代码
`

1.  GET semantic_text/_search
2.  {
3.    "query": {
4.      "match": {
5.        "inference_field": "What is Baidu company?"
6.      }
7.    }
8.  }

`AI写代码

很显然它天生支持多语言。

有人可能想知道,这个到底是怎么做到的。答案是是它在底层自动使用了 EIS (Elastic Inference Service)。详细的连接步骤,请参考文章 "跳过 MLOps:通过 Cloud Connect 使用 EIS 为自管理 Elasticsearch 提供托管云推理"。

更多详情,请观看视频:

www.bilibili.com/video/BV1BK...

相关推荐
leoZ2312 小时前
10-Git 仓库蒸馏术:从代码仓库到 OpenClaw 虚拟人-蒸馏工具链
大数据·git·深度学习·神经网络·目标检测·elasticsearch·lstm
艾伦_耶格宇3 小时前
【DOCKER容器实战】-3 ElasticSearch + Kibana
elasticsearch·docker·jenkins
Sayai1 天前
Elasticsearch 日志索引设计:按小时切分 + 小时内 Rollover 兜底(ILM 实战,附完整脚本)
大数据·elasticsearch·搜索引擎
Elasticsearch1 天前
生产环境向量搜索的一个设置:vectordb_document 模式如何自动调优 Elasticsearch
elasticsearch
【赫兹威客】浩哥1 天前
基于SpringBoot+Vue3的舆情文本分析系统|Elasticsearch检索+情感分析+话题热度追踪 毕设项目
spring boot·elasticsearch·课程设计
玉&心1 天前
在grafana中加入elasticsearch的日志dashboard
elasticsearch·grafana
Elasticsearch1 天前
让大模型思考,让小模型执行:在 Elastic Workflows 中拆分 LLM 成本
elasticsearch
Elastic 中国社区官方博客2 天前
ES95:面向 Elasticsearch 时间序列指标的自适应压缩
大数据·运维·elasticsearch·搜索引擎·架构·全文检索
编程令我快乐2 天前
模型配置及使用ccSwich管理
大数据·elasticsearch·搜索引擎
可遇_不可求2 天前
合集:LangChain智能体开发(四)langchain-elasticsearch
elasticsearch·langchain