AI视觉相关的预训练模型、公开数据集

一、视觉相关的预训练模型 有很多,以下是一些常见的预训练模型及其对应的公开数据集:

  1. ResNet:ResNet 是一种卷积神经网络(CNN)模型,由 Microsoft Research 开发。ResNet 在 ImageNet 数据集 上进行了预训练,可以用于图像分类 任务。
  2. VGG:VGG 是一种卷积神经网络(CNN)模型,由牛津大学开发。VGG 在 ImageNet 数据集 上进行了预训练,可以用于图像分类 任务。
  3. Inception:Inception 是一种卷积神经网络(CNN)模型,由 Google 开发。Inception 在ImageNet 数据集 上进行了预训练,可以用于图像分类 任务。
  4. DenseNet:DenseNet 是一种卷积神经网络(CNN)模型,由Facebook AI Research开发。DenseNet 在 ImageNet数据集 上进行了预训练,可以用于图像分类 任务。
  5. MobileNet:MobileNet 是一种轻量级的卷积神经网络(CNN)模型,由 Google 开发。MobileNet 在 ImageNet 数据集 上进行了预训练,可以用于图像分类 任务。
  6. YOLO:YOLO 是一种目标检测模型,由 Joseph Redmon 等人开发。YOLO 在COCO 数据集 上进行了预训练,可以用于目标检测 任务。
  7. Mask R-CNN:Mask R-CNN 是一种目标检测模型,由Matterport, Inc.开发。Mask R-CNN 在COCO数据集 上进行了预训练,可以用于目标检测语义分割 任务。
  8. Faster R-CNN:Faster R-CNN 是一种目标检测模型,由NVIDIA开发。Faster R-CNN 在COCO数据集 上进行了预训练,可以用于目标检测 任务。
  9. SSD:SSD 是一种目标检测模型,由 Google Brain 团队开发。SSD 在COCO数据集 上进行了预训练,可以用于目标检测 任务。
  10. RetinaNet:RetinaNet 是一种目标检测模型,由 Facebook AI Research 开发。RetinaNet 在COCO数据集 上进行了预训练,可以用于目标检测 任务。

二、视觉领域开源的数据集 有很多,以下是一些常见的数据集及其包含的类别和样本数量:

  1. ImageNet:ImageNet是一个大规模的图像分类 数据集,它从2007年开始建立,包含超过1400多万张图片和2万多的分类。ILSVRC(ImageNet Large-Scale Visual Recognition Challenge)比赛常用的一个子集是ILSVRC2012,它包含1000个分类,每个分类约有1000张图片,总计约120万张训练图片。ImageNet主要为图像分类、检测、定位等任务提供数据支持。
  2. MS COCO (Microsoft Common Objects in Context):COCO是由微软提供的大规模的目标检测语义分割 数据集,包含80个类别的图像,每个类别大约有1000张。
  3. PASCAL VOC:PASCAL VOC 是一个目标检测语义分割 数据集,包含 20 个类别的图像,每个类别大约有 2000 张图片。
  4. CIFAR-10:CIFAR-10 是一个小型的图像分类 数据集,包含 10 个类别的图像,每个类别大约有 6000 张图片。
  5. CIFAR-100:CIFAR-100 是一个小型的图像分类 数据集,包含 100 个类别的图像,每个类别大约有 6000 张图片。
  6. STL-10:STL-10 是一个小型的图像分类 数据集,包含 10 个类别的图像,每个类别大约有 5000 强烈建议。
  7. Open Images Dataset:由谷歌提供的图像数据集,包含了大约900万个带有图像级别标注和大约250万个带有目标边界框标注的图像。这个数据集被用于各种计算机视觉任务,包括目标检测图像分类和场景理解等。
  8. MNIST Handwritten Digits:一个经典的手写数字识别数据集,包含70,000张大小为28x28的灰度图像。
  9. Oxford Flowers 102:包含102个不同花卉类别的数据集,适用于图像分类任务。
  10. Stanford Dogs Dataset:专注于狗的品种识别,包含超过2万张不同品种狗的图像。
相关推荐
Coder_Boy_26 分钟前
DDD从0到企业级:迭代式学习 (共17章)之 四
java·人工智能·驱动开发·学习
木头左34 分钟前
LSTM量化交易策略中时间序列预测的关键输入参数分析与Python实现
人工智能·python·lstm
king王一帅1 小时前
流式渲染 Incremark、ant-design-x markdown、streammarkdown-vue 全流程方案对比
前端·javascript·人工智能
AI营销实验室1 小时前
AI CRM系统推荐,原圈科技赋能地产销售
人工智能·科技
cskywit1 小时前
MobileMamba中的小波分析
人工智能·深度学习
ws2019071 小时前
智行未来,科技驱动:AUTO TECH China 2026广州展将于11月27日举办!
人工智能·科技·汽车
HyperAI超神经1 小时前
【vLLM 学习】Prithvi Geospatial Mae
人工智能·python·深度学习·学习·大语言模型·gpu·vllm
赫凯1 小时前
【强化学习】第一章 强化学习初探
人工智能·python·强化学习
百锦再1 小时前
AI赋能智慧客服与人工客服融合系统企业级方案
人工智能·ai·aigc·模型·自然语言·赋能·只能
"YOUDIG"2 小时前
AI智能匹配:一站式电脑配置推荐平台——科学原理与个性化服务解析
人工智能