昇思大模型学习·第一天

mindspore快速入门回顾

  • 导入mindspore包

  • 处理数据集

    • 下载mnist数据集
    • 进行数据集预处理
      • MnistDataset()方法
      • train_dataset.get_col_names() 打印列名信息
      • 使用create_tuple_iterator 或create_dict_iterator对数据集进行迭代访问
  • 网络构建

    • mindspore.nn: 构建所有网络的基类
    • 用的层有
      • Flatten
      • Dense
      • ReLU
  • 模型训练

    • 正向计算
      • logits:预测结果
      • label:正确标签
      • loss:预测损失
    • 反向传播
      • parameters:模型参数
      • grandients:loss梯度
    • 参数优化:将梯度更新到参数上。
    • 步骤:
      • 定义正向计算函数
      • 使用value_and_grad通过函数变换获得梯度计算函数。
      • 定义训练函数,使用set_train设置为训练模式,执行正向计算、反向传播和参数优化。
  • 保存模型

  • 加载模型

相关推荐
郭子涵本人7 小时前
嘉立创eda学习
学习
智车科技7 小时前
泊车出海兑现技术红利,知行科技新获五泊车项目量产定点
大数据·人工智能·科技
安达发公司7 小时前
安达发|生产排单软件,让铅酸电池制造流程快、准、稳
大数据·人工智能·制造·aps高级排程·aps排程软件·安达发aps·生产排单软件
chian-ocean7 小时前
解锁 Vibe Coding 无限畅享模式:如何用 AI Ping + Cline 打造“全模型”开发流
大数据·人工智能
七夜zippoe7 小时前
轻量级模型实战:使用OpenLLM构建生产级大模型服务
大数据·人工智能·机器学习·架构·openllm
ar01237 小时前
AR眼镜赋能远程协作:效率与安全双提升
人工智能·ar
d111111111d7 小时前
什么是野指针,在STM32中如何避免野指针问题
笔记·stm32·单片机·嵌入式硬件·学习
西格电力科技7 小时前
光伏策略控制服务器如何成为电站智慧转型的中枢与关键一步?
运维·服务器·人工智能·分布式·能源
skywalk81637 小时前
试试这个模型Qwen3-Coder-30B-A3B-Instruct
人工智能
2301_764441337 小时前
跨城市人类移动行为预测
人工智能·机器学习·数学建模