用 MCP 把找读抽做成一条信息流水线
信息类任务有一个稳定的三段结构:找来源、读正文、抽成表。把它固化成流水线,比每次临时问一遍要省得多。本文给出可复制的模板与验收标准。
一、为什么是这三段
| 段落 | 解决的问题 | 工具 |
|---|---|---|
| 找 | 把"我记得"换成"有来源" | 搜索 |
| 读 | 把长文压成要点,保留数字与单位 | 网页解析 |
| 抽 | 让结果可对账 | 结构化抽取 |
顺序不能反:先有来源,再有正文,最后才抽表。跳过第一步直接让模型"总结一下",得到的是一段无法追溯的散文。
二、任务句模板
查最近 {N} 天关于 {主题} 的资料,给 {K} 条,
每条包含标题、发布日期、原文 URL,不要合并成一段;
读其中 {M} 条的正文,提炼 3 点,保留原文数字与单位;
把 {字段列表} 抽成表格,缺失写"缺"。
三处关键约束:时间范围、条数、必须带 URL。
三、验收:可验证单位
- 打开其中一条链接,核对标题、日期、数字是否一致。
- 表里的每一格能不能追回来源?
- 缺值是"缺"还是被模型猜了一个?
四、把流水线接到 MCP
json
{
"mcpServers": {
"agent-toolkit": {
"url": "https://agent-toolkit.app.baizhi.cloud/mcp",
"headers": { "Authorization": "Bearer YOUR_KEY" }
}
}
}
```
起步工具集就是搜索、网页解析、结构化抽取三件,正好对应三段。一把最小权限 Key 接上即可。
## 五、常见失败与修正
| 失败表现 | 原因 | 修正 |
| --- | --- | --- |
| 输出像散文 | 没写"必须带 URL" | 补约束 |
| 数字对不上 | 允许"润色" | 要求保留原文数字与单位 |
| 表里有空洞却像填满了 | 缺值被猜 | 明确"缺失写缺,不推测" |
## 六、谁来负责最后一步
流水线负责搬运,判断仍归人。写进流程:**抽表可以自动,结论必须签字**。
## 小结
把"找读抽"做成流水线之后,你的时间从搜集转到判断------这才是接工具真正的收益。