yolo11-seg模型后处理输出节点

检测头节点分析总结

1. Bounding Box 头 (cv2) - 回归头部

  • /model.23/cv2.0/cv2.0.2/Conv_output_0: 1, 64, 80, 80

  • /model.23/cv2.1/cv2.1.2/Conv_output_0: 1, 64, 40, 40

  • /model.23/cv2.2/cv2.2.2/Conv_output_0: 1, 64, 20, 20

作用: 输出边界框回归参数,64个通道对应4个坐标×16个DFL(Distribution Focal Loss)bins,用于精确的边界框定位。

2. 分类头 (cv3) - 类别预测头部 7类

  • /model.23/cv3.0/cv3.0.2/Conv_output_0: 1, 7, 80, 80

  • /model.23/cv3.1/cv3.1.2/Conv_output_0: 1, 7, 40, 40

  • /model.23/cv3.2/cv3.2.2/Conv_output_0: 1, 7, 20, 20

作用: 输出7个类别的概率分数,每个空间位置对应7个类别的置信度。

3. 分割头 (cv4) - 掩码系数头部

  • /model.23/cv4.0/cv4.0.2/Conv_output_0: 1, 32, 80, 80

  • /model.23/cv4.1/cv4.1.2/Conv_output_0: 1, 32, 40, 40

  • /model.23/cv4.2/cv4.2.2/Conv_output_0: 1, 32, 20, 20

作用: 输出32个掩码系数,用于生成实例分割掩码,这三个不同尺度的输出会被合并。

数据流向:

  1. cv2和cv3头 → 通过Concat操作合并到最终的output0输出
  • cv2输出经过DFL处理链(Reshape→Transpose→Softmax→Conv→Slice→数学运算)→最终bbox坐标

  • cv3输出经过Sigmoid激活→最终类别概率

  1. cv4头 → 经过Reshape和Concat操作形成掩码系数 → 存储在output0的最后32个通道中

  2. 独立的分割路径 → 通过proto网络分支生成output1

  • 来源:来自主干网络的特征

  • 处理:Conv→ReLU→ConvTranspose(上采样)→Conv→ReLU→Conv→ReLU

  • 输出:1, 32, 160, 160 → 直接作为output1输出

多尺度检测策略:

  • Scale 0 (大物体): 80×80网格,适合检测较大目标

  • Scale 1 (中物体): 40×40网格,适合检测中等目标

  • Scale 2 (小物体): 20×20网格,适合检测较小目标

特征层 典型输入尺寸(以640×640图为例) 主要任务
P3 1, 128, 80, 80 检测小目标(<32×32像素)
P4 1, 256, 40, 40 检测中等目标(32--96像素)
P5 1, 512, 20, 20 检测大目标(>96像素)

对应的rknn模型图:

相关推荐
MicrosoftReactor8 分钟前
技术速递|智能体构建智能体:基于 Microsoft Agent Framework 与 Foundry 的 Skill 优先架构蓝图
ai·架构·agent·智能体·mcp
ALINX技术博客10 小时前
ALINX 亮相 2026 WAIC 世界人工智能大会,展示 AI 视觉 FPGA+GPU 异构计算与电子后视镜解决方案
人工智能·ai·fpga·世界人工智能大会·电子后视镜
JaydenAI10 小时前
[AG-UI详解-01]创建一个类似ChatGPT应用与Agent实时交互
ai·agent·ag-ui·maf
AI棒棒牛16 小时前
第11讲 | 目标检测任务:边界框、IoU、类别与置信度
人工智能·yolo·目标检测·yolo26
深度研习笔记17 小时前
OpenCV工业视觉实战06|ROI区域截取+局部精细化检测,锁定作业区域、屏蔽无效背景,大幅提升YOLO检测准确率
人工智能·opencv·yolo
xcLeigh20 小时前
Doubao-Seed-Evolving大模型接入教程|搭建全品类提示词+AI工具导航网页
前端·人工智能·python·ai·html·ai开发·豆包
俊哥V20 小时前
每日 AI 研究简报 · 2026-07-20
人工智能·ai
元闰子21 小时前
怎样才算是好的 Agent 记忆系统?
ai
GPUStack21 小时前
Day 0 实测|在 GPUStack 上部署 Inkling-BF16:8 卡 H20-141G 推理性能测试
ai·大模型·llm·gpu·vllm·gpu集群·sglang·gpustack
云卷云舒___________21 小时前
阿里开源Qwen3.8 2.4T模型预览版、并推出Token Plan订阅、DeepSeek Harness与V4正式版同发 | 7月20日 AI日报
ai·阿里·deepseek·ai日报·harness·qwen38·tokenplan