技术栈
大模型缓存
gs80140
5 天前
deepseek
·
大模型缓存
【大模型工程实践】LLM 提效降本指南:基于 Context Caching 与专属 Endpoint 的架构优化
目录【大模型工程实践】LLM 提效降本指南:基于 Context Caching 与专属 Endpoint 的架构优化
每天看一遍,防止恋爱&&堕落
2 年前
缓存
·
langchain
·
大模型
·
llm
·
agent
·
大模型缓存
5、大模型的记忆与缓存
本节主要介绍大模型的缓存思路,通过使用常见的缓存技术,降低大模型的回复速度,下面介绍的是使用redis和mem0,当然redis的语义缓存还可以使用一些rag的检索库进行替代
我是有底线的