昇思大模型学习·第一天

mindspore快速入门回顾

  • 导入mindspore包

  • 处理数据集

    • 下载mnist数据集
    • 进行数据集预处理
      • MnistDataset()方法
      • train_dataset.get_col_names() 打印列名信息
      • 使用create_tuple_iterator 或create_dict_iterator对数据集进行迭代访问
  • 网络构建

    • mindspore.nn: 构建所有网络的基类
    • 用的层有
      • Flatten
      • Dense
      • ReLU
  • 模型训练

    • 正向计算
      • logits:预测结果
      • label:正确标签
      • loss:预测损失
    • 反向传播
      • parameters:模型参数
      • grandients:loss梯度
    • 参数优化:将梯度更新到参数上。
    • 步骤:
      • 定义正向计算函数
      • 使用value_and_grad通过函数变换获得梯度计算函数。
      • 定义训练函数,使用set_train设置为训练模式,执行正向计算、反向传播和参数优化。
  • 保存模型

  • 加载模型

相关推荐
仙女修炼史4 分钟前
Making Convolutional Networks Shift-Invariant Again
人工智能·深度学习·计算机视觉
EasyGBS6 分钟前
从“联网互通”到“安全可信”:EasyGBS支持GB35114国密协议,覆盖全场景安防合规升级
大数据·人工智能·安全·gb28181·gb35114
程序员Linc10 分钟前
小智esp32小玩意2:了解面包板与小智最基本AI对话电路连接
人工智能
奔跑草-10 分钟前
【AI日报】每日AI最新消息2026-02-24
人工智能
币小路13 分钟前
BihuoPro 联合凯美国际大酒店:一次“数据平台+实体底盘”的深度耦合
大数据·人工智能
无忧智库13 分钟前
某港口集团“十五五”智慧港口数字孪生与自动驾驶集卡多车编队系统建设方案深度解析(WORD)
人工智能·机器学习·自动驾驶
taoqick14 分钟前
修改GRPO Advantages的一些思路(pass@k)
人工智能·机器学习·自然语言处理
Clarence Liu15 分钟前
用大白话讲解人工智能(19) AI Agent:从“对话框“到“智能助手“的进化
人工智能
confiself20 分钟前
GLM5+minimax2.5+qwen3.5技术报告对比学习
人工智能