技术栈

大模型缓存

gs80140
5 天前
deepseek·大模型缓存
【大模型工程实践】LLM 提效降本指南:基于 Context Caching 与专属 Endpoint 的架构优化目录【大模型工程实践】LLM 提效降本指南:基于 Context Caching 与专属 Endpoint 的架构优化
每天看一遍,防止恋爱&&堕落
2 年前
缓存·langchain·大模型·llm·agent·大模型缓存
5、大模型的记忆与缓存本节主要介绍大模型的缓存思路,通过使用常见的缓存技术,降低大模型的回复速度,下面介绍的是使用redis和mem0,当然redis的语义缓存还可以使用一些rag的检索库进行替代
我是有底线的