训练CDN基础代码

文章目录

时间

从开始在平台上搭建到现在可以在平台上训练已经4天了

有GPU平台一般是autoDL平台,白嫖200元平台是:https://cloud.lanyun.net/

整体流程

1.注册平台,以蓝耘为例子

卡从好变坏依次是:4090>3090>3080

2.选择好适当的版本后,租用

一般上传数据和代码的时候用"无卡开机模式",比较省钱

配置环境,如果不需要自己配置环境的话,那么也是无卡开机模式

3.上传数据

点击共享网盘,绑定阿里云盘,用阿里云盘上传数据集,快一点

4.ssh登录pycharm专业版

注意:一定是pycharm专业版也可以使用ssh远程登录

参考链接:AutoDL使用教程:1)创建实例 2)配置环境+上传数据 3)PyCharm2021.3专业版下载安装与远程连接完整步骤 4)实时查看tensorboard曲线情况

后续pycharm可以写,在官网上面也可以直接修改,一般修改路径,运行的时候输入

python main.py --你所需要的参数,即可以直接运行。

训练细节

1.后台运行:

参考链接:https://blog.csdn.net/weixin_57070738/article/details/137378235

bash 复制代码
nohup python -u main.py > /root/lanyun-tmp/output.log 2>&1 &

2.训练完成后关机

bash 复制代码
--a ddd --b ddd --r ss && shutdown

3.训练时间

一个epoch是12min(20min)

我一共设置了90个epoch,那么就是1080min(1800分钟),那就是30h,我是下午4:30开始训练的,那么第二天的9:30就可以结束。

一个小时3元,总共花费:90元

加上配置环境:总共花费100元

小结

失误点:

1.数据集上传慢

不用其他软件,推荐用阿里云盘,如果直接用压缩包,解压命令如下:

bash 复制代码
# 压缩。如果没有zip命令,安装命令:apt-get update && apt-get install -y zip
zip -r <自定义压缩包名称>.zip <待压缩目录的路径>

# 解压。如果没有zip命令,安装命令:apt-get update && apt-get install -y unzip
unzip  <待解压压缩包名称>.zip -d <解压到哪个路径>

我的就是

python 复制代码
unzip train.zip -d /images

压缩包在:/root/lanyun-tmp

生成的就是:/root/lanyun-tmp/images

2.ssh登录

都要勾选,以及下面这个同步文件可以自己选,比如:/root/wintest

平台上一般都要选择/root,也就是根目录下,这里没有wintest文件夹都可以系统会自己创建一个wintest文件夹。

创建好了以后进入JupyterLab,等文件都传输到JupyterLab后才会出现,慢慢等,不着急,文件越多传输越慢。

pycharm专业版会提示你正在上传,上传结束后会提示你上传成功,我一开始在代码里面放置了数据集,一共15G所以才这么慢,所以代码和数据集分开,数据集用阿里云盘传输,代码上传。

3.代码的路径要设置成平台的路径

/root/lanyun-tmp/images,举一个例子

运行的时候路径也要设置成平台的路径

相关推荐
南蓝9 分钟前
【AI 日记】调用大模型的时候如何按照 sse 格式输出
前端·人工智能
robot_learner12 分钟前
11 月 AI 动态:多模态突破・智能体模型・开源浪潮・机器人仿真・AI 安全与主权 AI
人工智能·机器人·开源
Mintopia39 分钟前
🌐 动态网络环境中 WebAIGC 的断点续传与容错技术
人工智能·aigc·trae
后端小张42 分钟前
【AI 学习】从0到1深入理解Agent AI智能体:理论与实践融合指南
人工智能·学习·搜索引擎·ai·agent·agi·ai agent
Mintopia42 分钟前
🧩 Claude Code Hooks 最佳实践指南
人工智能·claude·全栈
【建模先锋】1 小时前
精品数据分享 | 锂电池数据集(四)PINN+锂离子电池退化稳定性建模和预测
深度学习·预测模型·pinn·锂电池剩余寿命预测·锂电池数据集·剩余寿命
星空的资源小屋1 小时前
极速精准!XSearch本地文件搜索神器
javascript·人工智能·django·电脑
九年义务漏网鲨鱼1 小时前
【大模型学习】现代大模型架构(二):旋转位置编码和SwiGLU
深度学习·学习·大模型·智能体
CoovallyAIHub1 小时前
破局红外小目标检测:异常感知Anomaly-Aware YOLO以“俭”驭“繁”
深度学习·算法·计算机视觉
mqiqe1 小时前
【Spring AI MCP】六、SpringAI MCP 服务端 STDIO & SSE
java·人工智能·spring