昇思学习营-Deepseek-r1-distill-qwen-1.5b模型开发与适配课程内容和学习心得

Deepseek-r1-distill-qwen-1.5b介绍

Deepseek-v3和r1的版本通过8张141张nvidia h200 gpu进行训练,训练和运行成本高,为节约成本,deepseek推出蒸馏板模型,基于r1版本的模型生成的高质量推理数据,在小模型上进行监督微调(sft,无强化学习或者偏好对齐训练阶段),具体过程如下:

  1. 选用 Llama 3.1/3.3 和 Qwen 2.5 的 6 个开源模型
  2. 用 R1 生成 80 万条高质量推理数据
  3. 基于这些数据进行监督微调(SFT,无 RL 阶段)

DeepSeek-R1-Distill-Qwen-1.5B在香橙派上的开发与适配

其中由于香橙派的板有8-12T和20T不同的算力版本,因此价格也是不同的,部署及开发人员根据自身的情况选择合适的板子进行开发。

详细的配置教学可以扫下面的二维码;

香橙派板子调试前的环境准备工作

版本查看:

香橙派板子的Mindspore版本查看:

通过mindspore官网的命令来升级

Mindnlp版本:

香橙派板子模型及网络调试(查看当前板子是否能够支持模型的运行)

模型调试命令如下:

MindSpore NLP套件中有针对模型的ut测试,可通过pytest来测试模型在香橙派的训练和推理,并进行问题定位和调试

设置环境变量:

export RUN_SLOW=True

执行命令:

Pytest -v -s tests/transformers/models/qwen2/test_modeling_qwen2.py

由于MindSpore动态图下框架存在多线程异步⾏为,所以会出现python调⽤栈不准确的场景,为了精准定位在test_modeling_qwen2.py脚本中import mindspore之后的位置,加入如下代码,重新跑pytest,查看具体的报错位置并根据报错信息修改

mindspore.set_context(pynative_synchronize=True)

对香橙派板子调试模型时报错的一些处理案例

针对算子缺失的处理方式及在实际工程文件中修改对应代码

针对损失函数报错的处理方式

针对香橙派上Tensor索引/切片报错的处理方式

学习心得:

  1. 对于香橙派上面训练和运行的deepseek蒸馏版本模型的方式有初步的了解。
  2. 对香橙派板子调试前的部署流程有初步认识。
  3. 对香橙派板子上面部署及测试mindspore有初步了解,及对部分异常及错误处理有明确认识。
相关推荐
小新同学^O^13 小时前
简单学习 --> LangChain
python·学习·langchain
吃好睡好便好14 小时前
在Matlab中绘制阶梯图
开发语言·人工智能·学习·算法·机器学习·matlab
Restart-AHTCM14 小时前
LangChain学习之提示词模板 (Prompts) - 练习(2/8)
学习·langchain
YangYang9YangYan14 小时前
2026产品专员学习数据分析的价值与路径
学习·数据挖掘·数据分析
淘矿人14 小时前
【AI大模型】AI 大模型推理平台完整测评:8 家主流聚合服务对比分析
人工智能·sql·gpt·学习·github·php
我想我不够好。15 小时前
2026.5.20 消防监控学习 1.5hour
学习
爱喝水的鱼丶15 小时前
SAP-ABAP:数据类型与数据对象(8篇) 第七篇:进阶优化篇——基于类型与对象特征的性能优化技巧
运维·数据库·学习·性能优化·sap·abap·开发交流
知识分享小能手16 小时前
Flask入门学习教程,从入门到精通, 认识Flask路由 — 知识点详解 (2)
python·学习·flask
清平乐的技术专栏16 小时前
【Flink学习】(六)Flink 三大时间语义 + 水位线 Watermark
大数据·学习·flink
楼兰公子16 小时前
《深入理解Linux网络技术内幕》配套学习大纲 + 源码Demo + 进阶实战实例
linux·arm开发·学习