【阿里云试用计划】免费试用GPU

写在前面:本博客仅作记录学习之用,部分图片来自网络,如需引用请注明出处,同时如有侵犯您的权益,请联系删除!


文章目录


前言

算力在深度学习中扮演着非常重要的角色,深度学习模型通常包含大量的参数和复杂的计算图,需要对大规模数据进行训练和推断。随着数据集越来越大,各种深度学习任务如图像、扩散模型、多模态、大模型等对算力的要求也稳步较高、为提高模型性能网络参数也逐步提升,以至于想要体验都不方便,更别提需要训练网络的学生。因此白嫖算力成为一种无奈之举,下面提供一种途径:阿里云试用计划。希望对小伙伴们有帮助。

试用步骤

阿里云深度学习服务器和常见AutoDL、mistGPU略有不同,想要快速上手参考下列步骤。

网址:阿里云免费试用注意这是针对新用户的活动,截止时间8.31。因此需要注册一个账号。

界面如下:

  • 点击机器学习平台,进入下图
  • 点击交互式建模,最好看下试用教程。教程是stable-diffusion,因此体验文字(英文)生成图像跟着教程即可。立即试用,进入下图
  • 跟着试用教程,创建实例。这里是我以前创建的实例。创建实例,进入下图
  • 配置实例。名称啥的随意,注意选择GPU、镜像(体验教程记得选择stable-diffusion的镜像)。创建实例,进入下图
  • 确认配置和金额后创建,如需要安全组、交换机等可自行创建。确认无误后创建
  • 再次进入交互式建模,可以看到就创建好实例了,后面就是环境和数据上传了。
  • 选择实例进入,可以具体的配置信息。
  • 开机进入实例,主要是jupyter、webIDE、终端。教程stable-diffusion主要在jupyter中,创建配置环境并实现生成图像。如果需要配置自己的环境,进入终端,使用pip配置即可。
  • 数据,默认挂载需要oss或者ssd,如果数据集很大的话还是建议去挂载。数据不大直接上传打包上传即可,避免其他一些操作。调试修改使用webIED,这个使用ssh和比较麻烦,不方便和pycharm配合使用。

  • 在解压出来,使用以下命令

  • unzip yourdata.zip -d unzip_path

  • 最后运行,芜湖起飞。


问题

No CUDA GPUs are available

详细的报错内容:出现在 .to(device)

python 复制代码
torch._C._cuda_init() No CUDA GPUs are available

但是torch显示cuda可用,如下

python 复制代码
torch.cuda.is_available()  # true
torch.cuda.device_count()  # 1

解决办法:

在脚本中添加:

python 复制代码
os.environ['CUDA_VISIBLE_DEVICES'] = '0'

无故被killed

报错截图如下:

原因:占用的显存太大,系统为保持稳定,kill进程。

解决办法:调小参数,如batch-size等,占用显存略小于16G即可。

致谢

欲尽善本文,因所视短浅,怎奈所书皆是瞽言蒭议。行文至此,诚向予助与余者致以谢意。

相关推荐
冷存储观察3 小时前
Gigaom雷达报告反映的非结构化数据管理技术应用趋势
大数据·人工智能·云计算·数据安全·企业数据管理·数据基础设施
weisian1513 小时前
入门篇--知名企业-20-阿里巴巴-8--阿里云PAI:AI开发的“全自动装配线”
人工智能·阿里云·云计算·pai
chao_6666663 小时前
【MCP】Claude Code for VS Code 配置阿里云 MCP 工具教程
阿里云·云计算·claude·mcp
未来之窗软件服务5 小时前
服务器运维(二十二) 服务器安全探针封装—东方仙盟练气期
运维·云计算·仙盟创梦ide·东方仙盟·服务器探针
2401_865854885 小时前
腾讯云的轻量8核16g可以有哪些场景使用
云计算·腾讯云
翼龙云_cloud5 小时前
腾讯云渠道商:如何在CVM 上手动搭建 LNMP 环境?
运维·服务器·云计算·腾讯云
Akamai中国5 小时前
分布式边缘推理正在改变一切
人工智能·分布式·云计算·云服务
Ydwlcloud6 小时前
Gemini API 与 Vertex AI:Google Cloud 如何统一AI开发与部署的格局
大数据·服务器·人工智能·云计算·googlecloud
拾光Ծ6 小时前
进程程序替换与exec函数族详解 与进程替换实战:自主Shell命令行解释器实现
linux·运维·服务器·阿里云·解释器模式
AKAMAI17 小时前
分布式边缘推理正在改变一切
人工智能·分布式·云计算