【自然语言处理与大模型】LangChainV1.0入门指南:AgentState介绍

AgentState是LangChain中用来表示智能体 在执行过程中描述当前状态 的核心数据结构。它是整个工作流的"上下文容器"或"共享内存",在各个节点之间传递,并随着流程推进不断被读取、修改和持久化。所以我一般叫他**"运行时上下文状态对象"**

一、AgentState本质

它本质就是一个TypedDict,里面包含了任务执行过程中的状态数据(比如对话历史、中间结果、用户信息等)。它由下面三个组件组成:

组件 说明
State(状态) 在图中流动的共享内存对象,存储用户输入、中间结果、工具调用日志等
Schema(模式) 规定状态的数据结构和类型(通常用 TypedDict 或 Pydantic 定义)
Reducer(归约器) 控制状态更新方式的函数(默认是覆盖,也可以追加、合并等)

二、LangChain中的AgentState

在LangChain和LangGraph里面,提供了开箱即用的默认状态类,最常见的就是MessagesState

1、 默认 MessagesState

python 复制代码
# 从langgraph中导入它
from langgraph.graph import MessagesState


# 就等价于自己手动定义了一个TypedDict
from typing import TypedDict, Annotated
import operator

class MessagesState(TypedDict):
    messages: Annotated[list[BaseMessage], operator.add]
  • messages 字段 :存储完整的对话消息序列(HumanMessage, AIMessage, ToolMessage 等)。
  • Annotated[..., operator.add] :这是关键!它表示当多个节点返回对 messages 的更新时,不是覆盖,而是追加(concatenate)。这确保了对话历史不会丢失。

2、自定义AgentState

完全可以自己扩展默认状态,添加业务所需字段。

python 复制代码
from typing import TypedDict, Annotated, Optional
from langgraph.graph import MessagesState
from langchain_core.messages import BaseMessage
import operator

class CustomAgentState(MessagesState):
    user_id: str                          # 用户标识
    session_data: dict                    # 会话级临时数据
    task_status: Optional[str]            # 任务状态("pending", "completed")
    search_results: Annotated[list[dict], operator.add]  # 工具调用结果(可追加)

然后在创建 Agent 时传入自定义的运行时上下文状态对象。

python 复制代码
# 假设之前定义好了下面的参数
agent = create_agent(
    model=llm,
    tools=[search_tool],
    state_schema=CustomAgentState,   # ← 传入自己定义的
    checkpointer=checkpointer
)

调用的时候传入在AgentState中自定义的字段。

python 复制代码
# config 作用是langgraph的可配置参数,用来控制运行时上下文。
config = {"configurable": {"thread_id": "1"}}  # 线程级会话 id 当 Agent 被调用时,LangGraph 会自动从 检查点器Checkpointer中加载该 thread_id 对应的最新状态

# 初次调用输入数据,作用是传递给Agent,初始化State更新
inputs = {
    "messages": [{"role": "user", "content": "查一下北京天气"}],
    "user_id": "u_123",
    "session_data": {"locale": "zh-CN"}
}

response1 = agent.invoke(input=inputs, config=config)

# 后续调用只需提供新消息,其他状态自动恢复
next_inputs = {"messages": [{"role": "user", "content": "那上海呢?"}]}
response2 = agent.invoke(next_inputs, config=config)  # 仍记得 user_id 和之前的问题
相关推荐
To_OC2 小时前
面试被问了三回三栏布局,这次我终于把 BFC 那层窗户纸捅破了
前端·css·面试
To_OC2 小时前
啃完 TS 工具类型我发现:Pick 和 Omit 原来就是一层窗户纸
前端·面试·typescript
风月说与山鬼4 小时前
三、大括号语法
前端·react.js
kyriewen4 小时前
我把最常踩的8个CORS跨域报错整理了一遍——第8个去年还不存在
前端·javascript
Csvn4 小时前
🕰️ 闭包 + setTimeout 的 5 个经典陷阱:为什么定时器看到的永远不是最新的值?
前端
lilian2335 小时前
Harmony os 技术实战|拼豆制图27:用单字符编码承载 50 张 70×70 图纸
前端·数据库·华为·harmonyos
CarIise5 小时前
CSS选择器与样式关联
前端·css·tensorflow
里欧跑得慢6 小时前
CSS 模块化架构的演进:BEM、CSS Modules 到 CSS-in-JS 的反思
前端·css·flutter·web·css-in-js
IT_陈寒7 小时前
Vue的computed属性把我坑惨了,原来我一直用错姿势
前端·人工智能·后端