技术栈
缓存
小宋1021
2 天前
人工智能
·
缓存
大模型应用如何控制成本与延迟:Token、缓存、流式和降级实战
本文定位:AI 应用性能 / 成本治理 / 高可用设计示例环境:Java 21、Spring Boot 3.3、Redis、PostgreSQL、OpenTelemetry。模型价格会变化,文章只讨论测量与治理方法,不绑定某个供应商价格。
野生技术架构师
4 小时前
数据库
·
redis
·
缓存
Redis 和 MySQL 如何保证数据一致性?先更新数据库还是先删缓存,延迟双删、MQ、Canal 一次讲透
先给结论:大多数读多写少的 Cache-Aside 业务,优先采用“提交数据库事务 → 删除缓存 → 下一次读取回源重建”,同时必须有 TTL。删除失败不能只记日志,重要数据应进入持久重试;跨服务可升级到 Outbox + MQ;写入口很多可使用 binlog CDC/Canal。它们提供的是可度量的最终一致,不是跨 MySQL 与 Redis 的天然强一致。
Patrick在香港
6 小时前
python
·
缓存
·
prompt
Claude API 成本直降90%:Prompt Caching 提示词缓存 Python 实战
同一个 1 万 token 的系统提示,不带缓存每次调用要 $0.03,带上缓存后第 4 次起每次只要 $0.003。到第 100 次调用,账单是 $0.33 而不是 $3.00。这个差价,就是 cache_control 一个参数带来的。
spter。
1 天前
数据库
·
redis
·
缓存
Redis 与 Single-flight 的分工与协作
在 AI 问答、报告生成和复杂查询中,一次请求往往要等待几秒甚至几十秒。请求执行期间,用户可能连续点击提交,前端可能因为超时发起重试,网关也可能重放请求。
NeilYuen
1 天前
linux
·
c++
·
redis
·
缓存
【vemory】高性能KV存储AOF方案设计
vemory 是我自研的一个高性能 KV 存储项目,本系列博客谈及的源码主要是是纯 C 实现的极致优化版,然而,本项目的 C++ 版全部开源(结合 cursor AI 进行的迁移版),感兴趣的小伙伴可以查看Github - Vemory。
LuminousCPP
1 天前
c语言
·
数据结构
·
经验分享
·
链表
·
缓存
数据结构基础篇(二):顺序表与链表全方位对比|从内存布局到 CPU 缓存理解底层差异
在写完动态顺序表的增删改查、单链表的反转与相交等经典题型后,我曾一度以为自己已经吃透了这两种最基础的线性表。在最初的认知里,二者的区别无非就是:顺序表是连续的数组,按下标找元素快;链表是节点加指针,插删方便。
清水白石008
1 天前
python
·
安全
·
缓存
Python 如何设计一个线程安全的缓存?从锁策略、LRU 到工程化实战
在很多 Python 项目里,缓存往往是最容易被“低估”的模块之一。刚开始,我们可能只是随手写一个字典:
番茄炒鸡蛋加糖
2 天前
缓存
项目技术点总结--四大核心技术+缓存
内容;Seata AT、Sentinel、QLExpress、DockerCompose 四大核心技术 + Redis 底层、Caffeine+Redis 二级缓存、缓存三大问题
大飞记Python
2 天前
人工智能
·
缓存
AI大模型Token计费全解析:输入/输出、缓存命中、阶梯计价一文看懂
大家好,我是搞自动化的大飞~最近都在说DeepSeek斩杀线——意思是AI的极致性价比(虽然梁圣也涨价了)
Rain的Java大神之路
2 天前
java
·
数据库
·
redis
·
后端
·
缓存
·
面试
·
架构
线上接口负载满了如何解决
这是最关键的一步,先保住系统不雪崩,再谈其他。整理了面试真题、每日技术知识点、系统学习路线,√X搜「Rain的Java 大神之路」 每天拆一个知识点,陪你悄悄变强,有空来坐坐。
天疆说
2 天前
linux
·
运维
·
缓存
04 稳定性与性能调优实录:OOM 崩溃、并发槽位、前缀缓存与 DSpark 调参
《DeepSeek-V4-Flash 本地部署与公网服务化》系列 · 第 ④ 篇 / 共 5 篇 ① 硬件选型与 llama.cpp 部署 | ② API 鉴权与腾讯云公网桥接 | ③ 多协议支持:Anthropic 与 Responses API | ④ 稳定性与性能调优实录(本篇) | ⑤ 客户端接入:pi 与各类 SDK
csdn2015_
2 天前
spring boot
·
缓存
·
mybatis
springboot +mybatis 查询myql开启程序级别缓存
在 Spring Boot + MyBatis 架构中,所谓的“程序级别缓存”(应用层缓存)通常有两种实现方式:
隔窗听雨眠
2 天前
缓存
缓存增强生成CAG:用预加载KV缓存突破RAG实时检索瓶颈
检索增强生成已成为大语言模型接入外部知识的主流方案,广泛应用于知识助手、内部搜索工具和客户支持等生产场景。通过从向量数据库检索相关文档并注入提示,RAG让模型能在不重新训练的情况下生成更准确、更及时的回答。
光影少年
2 天前
开发语言
·
前端
·
javascript
·
react native
·
react.js
·
缓存
·
前端框架
react离线缓存、图片缓存方案
React 做“离线缓存 + 图片缓存”,建议不要把它当成一个单一缓存问题,而是拆成三层:API / JSON 数据缓存
m0_38074387
3 天前
缓存
给大模型调用加一层本地缓存,让重复请求直接命中磁盘
调试一个带大模型的脚本时,最磨人的不是写代码,是等。改一行提示词模板,重跑,前面十几个已经跑通的样本又要重新请求一遍,几十秒过去了,才轮到你真正想看的那一条。
FakeOccupational
3 天前
笔记
·
stm32
·
缓存
【电路笔记 STM32】Cortex-M7 内核上的数据缓存(D-Cache)结构+MPU+DMA&Cache+STM32CubeMX配置
MPU 是 Memory Protection Unit(内存保护单元)是现代微控制器(如 STM32H7 的 Cortex-M7 内核)中内置的一个硬件模块,主要作用是监控和管理 CPU 对内存的访问行为 :
l1t
3 天前
数据库
·
缓存
·
postgresql
DeepSeek总结的在 pg_stat_statements 中诊断高基数工作负载
来源:https://pganalyze.com/blog/postgres-in-production-pg-stat-statements-deep-dive-part-6
2401_89491553
3 天前
运维
·
服务器
·
数据库
·
人工智能
·
缓存
·
开源
新手落地 Geo 优化:源码下载、依赖安装、数据库初始化完整步骤
Geo 优化(通常指地理位置相关的数据库优化或地理信息系统的性能调优)是许多涉及 LBS(基于位置的服务)应用的关键环节。对于新手开发者而言,从零开始搭建一个可以进行 Geo 优化的环境往往面临诸多挑战,例如源码获取、复杂的依赖项、数据库配置等。本文将提供一个清晰、完整的步骤指南,帮助你快速完成 Geo 优化环境的搭建,为后续的性能分析和调优打下坚实基础。
2401_89491553
3 天前
java
·
服务器
·
后端
·
缓存
·
开源
Geo 优化源码部署避坑指南:解决访问异常、定位失效、收录卡顿问题
在当今的互联网应用中,地理位置(Geo)服务已成为提升用户体验、实现精准营销和优化运营效率的关键能力。无论是外卖配送、出行导航、本地生活推荐,还是内容分发网络(CDN)的智能调度,其背后都离不开高效、稳定的 Geo 服务支撑。
祈禾
4 天前
运维
·
数据库
·
redis
·
笔记
·
分布式
·
缓存
Redis三大缓存问题与分布式锁
用户查询数据库、缓存都不存在的数据,比如传-1、负数用户ID、随机垃圾参数。 缓存查不到数据不会写入空记录,请求每次都会落到MySQL。黑客恶意批量请求不存在key,会直接压垮数据库。