pytorch 报错 the graph are freed when you call .backward() or autograd.grad()

原来 的环境 是 python 3.7 torch1.13.1 环境 下面跑通的代码

到 python 3.10 和torch 2.3.1报错

File "/mnt/workspace/t.py", line 200, in train

d_loss.backward()

File "/usr/local/lib/python3.10/site-packages/torch/_tensor.py", line 525, in backward

torch.autograd.backward(

File "/usr/local/lib/python3.10/site-packages/torch/autograd/init.py", line 267, in backward

_engine_run_backward(

File "/usr/local/lib/python3.10/site-packages/torch/autograd/graph.py", line 744, in _engine_run_backward

return Variable._execution_engine.run_backward( # Calls into the C++ engine to run the backward pass

RuntimeError: Trying to backward through the graph a second time (or directly access saved tensors after they have already been freed). Saved intermediate values of the graph are freed when you call .backward() or autograd.grad(). Specify retain_graph=True if you need to backward through the graph a second time or if you need to access saved tensors after calling backward.

解决 d_loss.backward(retain_graph=True)

这个错误信息表明你尝试在一个已经进行了反向传播的计算图中再次进行反向传播,但是计算图的中间变量在第一次反向传播后已经被释放了。在 PyTorch 中,当你调用 `.backward()` 方法时,计算图的中间变量默认是不会被保留的,这意味着你不能在同一张图上再次进行反向传播。

错误信息中提到了两种可能的情况:

  1. 你尝试在同一个计算图中进行了第二次反向传播。

  2. 你尝试在调用 `.backward()` 之后直接访问已经释放的保存的张量。

如果你确实需要在同一个计算图中进行多次反向传播,或者在调用 `.backward()` 之后还需要访问中间变量,你可以在第一次调用 `.backward()` 时添加 `retain_graph=True` 参数。这会告诉 PyTorch 在进行反向传播时保留计算图,以便你可以再次使用它。

修改后的代码示例如下:

```python

d_loss.backward(retain_graph=True)

```

请注意,使用 `retain_graph=True` 可能会增加内存的使用,因为计算图的中间变量不会被立即释放。因此,只有在你确实需要保留计算图时才应该使用这个参数。

另外,如果你在一个循环中多次调用 `.backward()`,确保在每次迭代结束时调用 `optimizer.zero_grad()` 来清除已经累积的梯度,否则梯度会累积起来,导致不正确的更新。

```python

for _ in range(some_iterations):

... 进行前向传播 ...

计算损失

d_loss = ...

反向传播

d_loss.backward(retain_graph=True)

更新模型参数

optimizer.step()

清除梯度

optimizer.zero_grad()

```

如果你不需要保留计算图,确保在每次迭代中都重新构建计算图,而不是重复使用同一个计算图。

相关推荐
小兜全糖(xdqt)2 分钟前
python cobnfluent kafka transaction事务
开发语言·python·kafka
纪伊路上盛名在3 分钟前
在vscode中使用colab的GPU算力
ide·vscode·python·编辑器·开发工具·gpu算力·colab
啊阿狸不会拉杆3 分钟前
《数字图像处理》第 12 章 - 图像模式分类
图像处理·人工智能·算法·机器学习·计算机视觉·分类·数据挖掘
Robot侠6 分钟前
ROS1从入门到精通 15: 机器人视觉 - 图像处理与计算机视觉
图像处理·人工智能·计算机视觉·机器人·ros·机器人操作系统
Robot侠7 分钟前
赋予 AI 记忆:在 RTX 3090 上搭建本地 RAG 知识库问答系统
人工智能·langchain·llm·llama·qwen·rag·chromadb
技术摆渡人8 分钟前
RK3588 边缘 AI 深度开发指南:从 Android NNAPI 源码到 LLM 大模型性能调优
android·人工智能
Coder_Boy_12 分钟前
AI技术栈入门-Spring AI+小程序-ESP32智能控制系统
人工智能·spring·小程序
说私域12 分钟前
“智能名片链动2+1模式S2B2C商城小程序”在群运营中的应用与效果
人工智能·小程序·开源
BoBoZz1912 分钟前
CapClip 模型的裁剪(平面裁剪与曲线裁剪)
python·vtk·图形渲染·图形处理
围炉聊科技14 分钟前
Vibe Coding实战从零开发小程序:AI协作的惊喜与踩坑
人工智能·小程序