第二章 深度学习之yolov8图像分割输出


文章目录


前言

本章介绍一下yolov8图像分割模型输入输出参数含义,增加自己的记忆


一、模型输入输出样例

bash 复制代码
Input:
	(1x3x1024x1024)
Output0:
	(1x32x256x256)
Output1:
	(1x54x21504)

二、详解

1.Input

1: 输入图像的张数
3: 输入图像的通道数量RGB
1024x1024: 输入图像的分辨率

2.Output0

1: 输出图像的张数
32:
256x256:

3.Output1

1: 输出图像的张数
54: 4(预测框xywh)+18(每个类别的置信度)+32(对应Output0的32)
21504: yolo分割的时候会将输入图像划分为3个尺度(8、16、32)的网格,每个尺度下的网格数量为128128、6464、32*32,加在一起为21504个网格对象

相关推荐
依然范特东5 小时前
动手学深度学习笔记--卷积层、微调
人工智能·笔记·深度学习
湘美书院--湘美谈教育6 小时前
湘美谈教育湘美书院大湘西文学系列:AI时代的武侠小说怎么写
大数据·人工智能·深度学习·机器学习·生活
Geoking.6 小时前
JSON vs JSONL:从数据格式到 AI Agent 的工程实践
人工智能·深度学习·json
workflower6 小时前
模型中心主义路径
大数据·人工智能·深度学习·机器学习·自动化·制造
王莎莎-MinerU7 小时前
MCP 解决的是工具接入,科研 Agent 还缺的是科学证据接口标准化
开发语言·网络·人工智能·深度学习·pdf·c#·php
MartinYeung57 小时前
[论文学习]MiCA:比LoRA和全参数微调学到更多知识
深度学习·学习·机器学习
满怀冰雪8 小时前
04-Paddle Tensor 基础:形状、数据类型、广播与索引
python·深度学习·神经网络·paddle
AI人工智能+9 小时前
银行回单识别技术通过AI驱动的智能文档理解方案,实现财务处理的革命性升级
深度学习·计算机视觉·自然语言处理·ocr·银行回单识别
湘美书院--湘美谈教育9 小时前
湘美书院主理人:AI世代武侠小说的基本特征与蕴意
大数据·人工智能·深度学习·机器学习·生活
FriendshipT9 小时前
Ultralytics:解读CBLinear模块
人工智能·pytorch·python·深度学习·目标检测