技术栈
elasticsearch
Elasticsearch
7 小时前
elasticsearch
训练量仅占 0.35%,竞争力却达到 100%:jina-embeddings-v5-omni 背后的冻结塔架构
作者:来自 Elastic Jon Avezbaki最新的 jina embeddings 模型可以为文本、图像、视频和音频生成 多模态 嵌入,在向量搜索方面能够与规模接近其 6 倍的模型竞争,而训练的权重仅占 0.35%。
扶苏1002
11 小时前
大数据
·
git
·
elasticsearch
同一个 Git 项目整出两份,切分支互不影响?两种方案实测
按你的思路改写:主线改为"检出已存在的本地分支"(日常 90% 的场景),把"-b 新建分支"降级为补充小节。
Elasticsearch
13 小时前
elasticsearch
用两行 JSON 替换你的 ILM 策略:数据流生命周期新增冻结层支持
作者:来自 Elastic Jon Avezbaki在 Elasticsearch 9.5 中,数据流生命周期中的 frozen_after 会自动将索引迁移到 对象存储 上的可搜索快照中,同时保持索引可查询,并与降采样和保留策略协同工作。
AI大模型-小雄
1 天前
大数据
·
数据库
·
elasticsearch
·
搜索引擎
·
chatgpt
·
后端开发
·
codex
Codex写分页接口为什么越翻越慢?用Cursor Pagination解决重复与漏数据
使用 Codex 编写列表接口时,分页几乎是最常见的需求之一。刚开始数据只有几百条时,下面这种写法通常没有明显问题:
Elasticsearch
1 天前
elasticsearch
深入浅出 Elastic 工作流(Workflows):核心架构与十一大顶级字段详解
在现代 IT 运维与安全运营中,自动化和编排能力已经成为团队提升效率、缩短响应时间(MTTR)的关键。作为 Elastic 生态中强大的自动化工具,Elastic 工作流(Workflows) 能够帮助团队无缝编排安全响应、可观测性诊断以及日常的数据管理流程。
Elasticsearch
1 天前
elasticsearch
在 Elasticsearch 中构建上下文:AI Indices 如何使用更少的 tokens 为更智能的 agent 提供支持
作者:来自 Elastic Kathleen DeRusso, Matt Nowzari, Apostolos Matsagkas, Peter Pisljar
淮北494
4 天前
linux
·
ubuntu
·
elasticsearch
ubuntu 22配置lazygit
这个就像编辑器一样看git diff的,有了lazygit了,感觉不需要在nvim里面配置git相关的了。
淮北494
1 天前
运维
·
服务器
·
git
·
ubuntu
·
elasticsearch
ubuntu22 默认输入法调整频率
在使用ubuntu22的默认输入法的时候,总是很讨厌,因为每次打字大出来的都不是我想要的,我想让他追随我的打字习惯,所以做了下面的配置。
Elasticsearch
2 天前
elasticsearch
Elasticsearch:使用 AI Agent 来创建 workflows
对于很多的开发者来说,创建一个没有错误的 workflow 是很困难的。事实上,你需要学习各种语法,并进行不断地测试。我当初创建了我第一个 workflow 也是借助了 AI 的力量才完成的。过程还是挺麻烦的。我需要不断地拷贝,粘贴并测试。自 Elastic Stack 9.5 一来,workflow 的窗口已经集成了 AI Agent。我们可以轻松地借助 AI 的力量来完成我们的设计。
gll773
2 天前
elasticsearch
RAG 检索层实战:Redis 缓存 + ES 混合检索 + BGE-Rerank 重排全链路落地与踩坑
近期基于 FastAPI + LangGraph 自研智能客服 RAG 平台,初期仅使用 Chroma 向量检索存在两大痛点:
Elasticsearch
2 天前
elasticsearch
ES 存日志很贵?我用 ES 9.5 把日志从 4.5G 压到 412M 压缩比11.2倍,日志硬扫每秒128万行!
作者:来自 Elastic 朱杰这是一次用真实生产形态日志数据做的实测:1641 万条日志,4631 MB 原始文本大小,ES 落盘后 412.5 MB,压缩比 11.2 倍,只剩原始体积的 8.91%。而同一份数据用 zip 压缩是 411.6 MB。区别是:zip 那份要先解压才能看一眼,而 Elasticsearch 那份可以按时间范围过滤、可以聚合、可以全量扫描——它是在线的、活的数据。
Elasticsearch
2 天前
elasticsearch
Elasticsearch 作为统一平台:引入第二套数据系统究竟要付出什么代价
作者:来自 Elastic Yannis Roussos 及 Bharath Aleti在五套系统中分别运行搜索、分析、指标、日志和向量检索,成本远不只是五份许可证。下面看看在实践中使用一个统一平台是什么样的。
Elastic 中国社区官方博客
2 天前
大数据
·
数据库
·
elasticsearch
·
搜索引擎
·
全文检索
Elasticsearch:列式索引模式 - Columnar index mode
注意:这个目前在 Elastic Stack 9.5 版本中是 Preview。后期版本有可能会发生变化。
Elasticsearch
2 天前
elasticsearch
Elasticsearch 的批量查询阶段如何在大规模场景下提升搜索性能
作者:来自 Elastic Ben Chaplin 及 Luca Cavanna批量查询阶段可以通过减少传输开销,并在集群中更好地分配归并(reduction)工作量,将搜索执行时间缩短一半。
Ramboooooooo
3 天前
elasticsearch
·
docker
·
skywalking
SkyWalking-10.4.0 Docker + Nacos + Elasticsearch 生产级部署手册
Apache SkyWalking 是一个开源、分布式系统可观测的性能分析平台。旨在为云原生、微服务和分布式架构提供完整的监控、追踪和诊断能力。SkyWalking 通过 Agent、SDK 等探针技术采集应用运行过程中的指标(Metrics)、分布式链路追踪数据(Distributed Tracing)、服务性能监控(Application Performance Monitoring(APM))、日志关联分析(Log Correlation)、服务拓扑分析(Service Topology)、以及持续
互联网中的一颗神经元
3 天前
大数据
·
安全
·
elasticsearch
04 — 安全撤销:改错了怎么退回去
摘要:本文系统讲解 Git 撤销操作的四种核心场景:1) 撤掉工作区未提交的改动(git restore);2) 取消暂存(git restore --staged);3) 修改最近一次提交(git commit --amend);4) 退回历史版本(git reset 的三种模式)。通过三区模型(工作区、暂存区、仓库)理解撤销的本质,强调「先问退哪一块,再选命令」的原则,重点区分 --soft、--mixed、--hard 的差异与风险,并提供安全操作习惯与真实场景示例,帮助读者安全、精准地撤销错误操作
Elasticsearch
3 天前
elasticsearch
Elasticsearch:列式索引模式 - Columnar index mode
注意:这个目前在 Elastic Stack 9.5 版本中是 Preview。后期版本有可能会发生变化。
Elasticsearch
3 天前
elasticsearch
从 CrashLoopBackOff 到根本原因,只需几秒:使用 Elastic Observability 自动化 20 分钟的 Kubernetes 调查流
作者:来自 Elastic Bahubali Shetti正值你值班期间,手机突然响起。CrashLoopBackOff。一个 Pod 卡在不断重启的循环中,而现在时间开始倒计时。
互联网中的一颗神经元
4 天前
大数据
·
git
·
elasticsearch
09 — .git 地图:打开那个隐藏文件夹
摘要: 本章深入探索 Git 仓库的核心——.git 隐藏文件夹。通过可视化地图和动手实验,你将了解 .git 目录结构及各文件/文件夹的作用,理解 Git 如何将版本历史、分支、暂存区等状态存储为普通文件。重点掌握 objects/(存储历史内容)、refs/(存储分支/标签引用)、HEAD(当前分支指针)、index(暂存区)和 logs/(操作日志)等核心组件的功能。通过观察 add、commit 等命令对 .git 文件的实际影响,你将不再视 Git 为黑盒,并为后续深入学习对象模型和引用机制打下
独行侠影a
4 天前
大数据
·
elasticsearch
·
搜索引擎
Elasticsearch海量数据查询优化:深度分页与聚合查询提速方案
在日常后端开发中,只要涉及日志检索、订单大数据列表、业务统计报表,基本都会用到 Elasticsearch。相比于MySQL,ES在全文检索、海量数据筛选上优势非常大。