网络流数据集处理(深度学习数据处理基础)

一、数据集处理

处理数据集是一个文件夹 一个文件夹处理的,将原网络流数据集 放入一个文件夹 处理转换成 Json文件。(数据预处理)然后将这些文件处理成目标文件格式 再分割成训练集和测试集。每次运行只会处理一个文件夹。

  • 运行train.py 导入训练集训练模型,训练完之后进行保存模型参数。
  • 运行test.py 导入测试集测试模型,因此我们需要使用模型参数保存代码。

如果我们需要将数据集4倍交叉验证分为4个部分,3个训练集,一个测试集。那就相当于运行三次train.py分别运行导入不同的三个训练集即可。如果每个部分都需要当做一次测试集,那就重复4次就行。

二、后门攻击训练

为了进行有监督训练,我们需要带有标签的数据集。

我们认为数据集是带有标签的,

训练这里分为几个步骤:

将训练集每64个网络流当做一个批次。

(1)选择一个投毒目标yt,在当前训练集批次中随机选择20%个投毒目标,进行以下处理:

  • 上一次网络流+当前网络流生成 触发器掩码m
  • 当前网络流 与 掩码的m[n+1,2n]相加,训练模型分类为目标类别yt

(2)对于不投毒的训练集,用正常标签训练。

相关推荐
碧海银沙音频科技研究院1 分钟前
结构化知识蒸馏(特征分布+关系知识)
人工智能
围炉聊科技2 分钟前
国内的大模型访问能访问墙外内容吗?
人工智能
fantasy_arch3 分钟前
LSTM和DenseNet区别
人工智能·rnn·lstm
Deepoch5 分钟前
发动机设计迎突破!Deepoc-M低幻觉模型重塑研发逻辑
大数据·人工智能·deepoc
Pocker_Spades_A6 分钟前
智能时代的操作系统范式:openEuler的AI就绪度深度评估
人工智能
Sirius Wu7 分钟前
智能体开发框架选型
人工智能·aigc
人工智能技术咨询.9 分钟前
【无标题】卷积神经网络(CNN)详细介绍及其原理详解(2)
人工智能
sendnews11 分钟前
红松亮相首届厦门银博会,以一站式社区平台展示退休生活新图景
大数据·人工智能
有Li12 分钟前
一种交互式可解释人工智能方法,用于改进数字细胞病理学癌症亚型分类中的人机协作|文献速递-文献分享
大数据·论文阅读·人工智能·文献
serve the people16 分钟前
TensorFlow 中雅可比矩阵计算方式
人工智能·矩阵·tensorflow