大模型agent中怎么做意图识别的?

文章目录

一、做意图识别的目的

在多agent架构中,首先需要通过意图识别技术解析用户输入的真实目的,为后续决策和行动提供基础。

二、怎么做的

  • 把待分类意图固定有限意图集合,
  • 小的分模型做初步判断
  • 针对置信度较低的,直接用大模型兜底
  • **原因:
    • 成本与推理开销问题
    • 响应速度差距大
    • 大模型容易发散、不稳定
    • 边界场景分工,各司其职(80% 简单请求小模型扛住,20% 难例大模型兜底)
    • 安全风控更可控

三、提高准确率的方法:

  1. 样本迭代 + 坏 case 回流
    线上收集识别错误案例,定期迭代微调分类模型、扩充规则词典,持续优化边缘口语、方言化、模糊表述的 case。
  2. 引入上下文连续性判断
    不只用单句识别,结合上一轮对话状态判断意图。
    比如上一轮正在问诊,用户短句回复,就优先判定为症状补充,避免误判成闲聊。
  3. 禁止越界意图 + 强拦截
    对诱导、越狱、非医疗诉求、恶意提问做独立黑名单意图,提前拦截,既提升准确率又兼顾安全。
  4. Prompt 约束 + 结构化输出
    大模型识别时,强制要求输出固定 JSON 意图结果,加角色约束与场景限定,杜绝自由文本输出带来的识别漂移。
相关推荐
老郑聊AI业财智造6 小时前
Transformer 技术架构与源码分析
人工智能·python·深度学习·语言模型·架构·transformer·软件工程
Tbisnic1 天前
BGE-M3 算法详解:从模型架构到三种检索方式的数学原理
算法·自然语言处理·大模型·bert·transformer·注意力机制
高洁012 天前
智能体的“记忆”难题
python·深度学习·机器学习·transformer
十三画者2 天前
【文献分享】ConfRetro:融合3D构象信息的逆合成预测Transformer框架
人工智能·深度学习·数据挖掘·数据分析·transformer·数据可视化
root_123456_2 天前
Transformer 架构二:多头注意力、位置编码与前馈网络
网络·架构·transformer·自学ai
大模型丫丫3 天前
Transformer架构详解:从Attention到GPT的演进之路
gpt·深度学习·transformer
root_123456_3 天前
注意力机制的诞生:从 Seq2Seq Attention 到注意力的本质
rnn·lstm·transformer·自学ai
大数据点灯人4 天前
【大模型】深度解答:OOV 与 Tokenizer 词汇表共用问题
人工智能·深度学习·ai·大模型·transformer
阿图灵4 天前
Seq2Seq Transformer 中英翻译实战:从 GRU 到 Transformer,BLEU 0.225 → 0.307
pytorch·深度学习·gru·transformer·机器翻译·seq2seq
XLYcmy4 天前
小红书 算法一面 七
llm·transformer·encoder·decoder·自注意力·deepseek·深度思考