大模型agent中怎么做意图识别的?

文章目录

一、做意图识别的目的

在多agent架构中,首先需要通过意图识别技术解析用户输入的真实目的,为后续决策和行动提供基础。

二、怎么做的

  • 把待分类意图固定有限意图集合,
  • 小的分模型做初步判断
  • 针对置信度较低的,直接用大模型兜底
  • **原因:
    • 成本与推理开销问题
    • 响应速度差距大
    • 大模型容易发散、不稳定
    • 边界场景分工,各司其职(80% 简单请求小模型扛住,20% 难例大模型兜底)
    • 安全风控更可控

三、提高准确率的方法:

  1. 样本迭代 + 坏 case 回流
    线上收集识别错误案例,定期迭代微调分类模型、扩充规则词典,持续优化边缘口语、方言化、模糊表述的 case。
  2. 引入上下文连续性判断
    不只用单句识别,结合上一轮对话状态判断意图。
    比如上一轮正在问诊,用户短句回复,就优先判定为症状补充,避免误判成闲聊。
  3. 禁止越界意图 + 强拦截
    对诱导、越狱、非医疗诉求、恶意提问做独立黑名单意图,提前拦截,既提升准确率又兼顾安全。
  4. Prompt 约束 + 结构化输出
    大模型识别时,强制要求输出固定 JSON 意图结果,加角色约束与场景限定,杜绝自由文本输出带来的识别漂移。
相关推荐
孙启超几秒前
【AI开发之Rust】第 3 课:字符串与复合类型 —— 数据怎么放
开发语言·人工智能·后端·rust·llm·transformer
June bug1 天前
【HCIA- AI(正课)】2.6.Transformer架构和Diffusion结构介绍
人工智能·深度学习·transformer
richard_first1 天前
Transformer与大语言模型:第18章 向量数据库
数据库·人工智能·自然语言处理·transformer·embedding
程序猿编码1 天前
LLM 技术迁移音频领域:基于 GGML 搭建 Roformer,端侧音乐人声分离实现详解
c++·llm·音视频·transformer·模型推理·ggml
程序猿编码2 天前
纯C++轻量计算机视觉推理引擎:基于GGML的端侧CV模型部署技术全解析
开发语言·c++·计算机视觉·大模型·transformer
运筹说2 天前
运筹说 第160期 | 大模型如何“思考”? Transformer架构图解
人工智能·深度学习·transformer
高洁013 天前
大模型是怎么“学会“的:预训练、微调、对齐三段论
python·深度学习·transformer·知识图谱·tornado
Allen_LVyingbo4 天前
2026医疗AI编程:医院信息工程部规模化编程与代码审核路径(上)
网络·人工智能·cnn·transformer·知识图谱·ai编程
小王2045 天前
Day 35:DETR与检测Transformer — 目标检测的范式革命
人工智能·深度学习·transformer
高洁015 天前
AI智能体落地价值:从工具赋能到产业重构,解锁企业降本增效新逻辑
人工智能·深度学习·机器学习·transformer·知识图谱