神经网络设计过程

1.可根据Iris特征直接判断

2.神经网络方法,采集大量的Iris特征,分类对应标签,构成数据集。

将数据集喂入搭好的神经网络结构,网络通过反向传播优化参数得到模型。

有新的网络送入到模型里,模型会给出识别结果。

3.具体实现过程。

Iris有4个特征,分类总共三种,构成的神经网络如下所示

MP模型

转化为Iris Y(1, 3) = X (1, 4) * W(4, 3) + b(3,) 三个偏置项

此网络为全连接网络

神经网络执行前向传播 y = x * w + b

因为W, B是随机初始化,所以答案不准确

运用损失函数定义预测值(y)与标准答案(y_)之间的差距。

损失函数可以判断当前W和b的优劣,当损失函数值最小时,W和b最优

损失函数的表达方法之一就是:均方误差:MSE(y, y_) =

表示网络前向传播推理与标准答案之间的差距。

目的:找到最优的W和b

梯度:函数对各个参数求偏导后的向量。函数梯度下降方向是函数减小的方向

梯度下降法:沿损失函数梯度下降的方向,寻找损失函数的最小值,得到最优的参数的方法。

学习率:当学习率设置的过小时,收敛过程变得缓慢,过大,会在错过最小值

梯度下降法更新参数的计算。 lr 学习率

求wt+1 = wt - lr*对wt求偏导

这里假设损失函数为(W+1)^2, 对w进行求偏导

复制代码
import tensorflow as tf

w = tf.Variable(tf.constant(5, dtype=tf.float32))
lr = 0.2
epoch = 40

for epoch in range(epoch):  # for epoch 定义顶层循环,表示对数据集循环epoch次,此例数据集数据仅有1个w,初始化时候constant赋值为5,循环40次迭代。
    with tf.GradientTape() as tape:  # with结构到grads框起了梯度的计算过程。
        loss = tf.square(w + 1)
    grads = tape.gradient(loss, w)  # .gradient函数告知谁对谁求导

    w.assign_sub(lr * grads)  # .assign_sub 对变量做自减 即:w -= lr*grads 即 w = w - lr*grads
    print("After %s epoch,w is %f,loss is %f" % (epoch, w.numpy(), loss))

# lr初始值:0.2   请自改学习率  0.001  0.999 看收敛过程
# 最终目的:找到 loss 最小 即 w = -1 的最优参数w
相关推荐
FII工业富联科技服务6 小时前
Omniverse + Isaac Teleop + 合成数据:工业富联机器人大脑训练+执行落地闭环拆解
大数据·人工智能·深度学习·机器学习·机器人·制造·具身智能
东风破_6 小时前
大模型格式化输出
人工智能
Shockang6 小时前
AI 研究偏好模型
人工智能
ZGIAI6 小时前
律师最贵的不是知识,是时间:哪些工作真的可以先交给 Agent?
人工智能·架构
东风破_6 小时前
讲透 SSE:从流式响应到 LangChain model.stream()
人工智能
β添砖java7 小时前
深度学习31注意力机制、注意力分数、使用注意力机制的seq2seq、自注意力
人工智能·深度学习
ZGIAI7 小时前
销售团队最缺的不是另一个 AI,而是有人把跟进这件事一直做下去
人工智能·架构
隔窗听雨眠8 小时前
MCP会成为Agentic AI的标准吗?技术演进、生态博弈与标准之路的深度分析
人工智能
2601_967659888 小时前
2026年多个网页快速提取重点、自动汇总、对比并整理成表格的AI工具清单
人工智能
IT古董8 小时前
AI资讯日报|2026年9月5日:GPT-6 Astra全量推送却遭“翻车“,奥特曼紧急致歉一天12条大新闻:OpenAI翻车、英伟达收购、最狠AI法案出台
人工智能