pytorch模型训练使用多GPU执行报错:Bus error (core dumped)(未解决)

问题信息

使用 cuda 进行训练

使用 4 个GPU进行训练

Epoch 1/20: 0%| | 0/3184 00:00\Bus error (core dumped)

执行方式

python 复制代码
 self.model = nn.DataParallel(self.model)
 self.model = self.model.to(self.device)

4张GPU均正常,单独指定使用任何一张都可正常执行,运行内存够大,但是一启动4GPU,4张显卡刚起来就error

相关推荐
染指111010 分钟前
103.RAG-LLamaIndex后端rag问答-聊天接口
前端·javascript·vue.js·人工智能
AI_yangxi1 小时前
短视频矩阵系统选哪家
大数据·人工智能·矩阵
Shockang7 小时前
AI Slop 治理实战
人工智能
Mr数据杨8 小时前
医学影像分类实战复盘 从 Kaggle 竞赛到可落地建模流程
人工智能·数据分析·kaggle竞赛
AI情绪识别开源9 小时前
检信 ALLEMOTION OS 加密打包可执行程序 — 全面测试报告版本: v1.3功能测试 / 性能测试 /
开发语言·数据结构·人工智能·功能测试
ZGIAI9 小时前
ZGI 迭代节点:批量资料的逐项处理
人工智能·架构
ZGIAI10 小时前
ZGI 知识检索:让业务回答有据可查
人工智能·架构
Asize10 小时前
框架的说明书是写给 AI 看的:我用 Next.js 搭了个博客
人工智能·代码规范·next.js
2601_9556624610 小时前
AI 配音工具 7 款实测:短视频、影视解说、小说推文音质横向对比
人工智能·音视频·语音识别·视频