LALIC环境安装过程

LALIC 按照官方环境installation步骤会报错,以下是建议的修正的安装流程

powershell 复制代码
conda create -n LALIC_env python=3.10
conda activate LALIC_env
pip install compressai==1.2.6
pip install ninja
pip install torchvision==0.19.0
pip install torch==2.4.0
pip install tensorboard

因为这个代码涉及到GPU与CUDA架构的问题,官方模型是在 single NVIDIA GeForce RTX 4090 GPU上训练出来的,我目前只在2080Ti上能够成功运行在A100上按照如下步骤解决完报错后重建图像是错误的,在A40或者H800上甚至没法跑,报错

powershell 复制代码
subprocess.CalledProcessError: Command '['ninja', '-v']' returned non-zero e

以下内容可以忽略


如果想试着在服务器 Slurm A100 环境下运行项目,顺利安装完如上环境后,LALIC 项目运行时有如下报错,如果同样遇到可以参考,但是不太建议,因为还是运行不了。

报错 1

报错内容:

powershell 复制代码
OSError: CUDA_HOME environment variable is not set. Please set it to your CUDA install root.

解决方案:

powershell 复制代码
conda install -c nvidia cuda-toolkit=12.4

报错 2

报错内容:

powershell 复制代码
ValueError: Unknown CUDA arch (10.0) or GPU not supported E0216 19:27:58.677000 139882420627264

解决方案:

(1)首先命令行运行 python,输入如下命令:

python 复制代码
import torch
print(torch.cuda.get_arch_list())

返回值如下:

powershell 复制代码
['sm_50', 'sm_60', 'sm_70', 'sm_75', 'sm_80', 'sm_86', 'sm_90']

,说明没有什么问题。

(2)只需在 sjob_LALIC.sh (也就是你的 Slurm 批处理命令文件中)中加入如下命令:

powershell 复制代码
export TORCH_CUDA_ARCH_LIST=""
相关推荐
yiyu07163 小时前
3分钟搞懂深度学习AI:实操篇:卷积层
人工智能·深度学习
曲幽3 小时前
数据库实战:FastAPI + SQLAlchemy 2.0 + Alembic 从零搭建,踩坑实录
python·fastapi·web·sqlalchemy·db·asyncio·alembic
用户8356290780518 小时前
Python 实现 PowerPoint 形状动画设置
后端·python
ponponon9 小时前
时代的眼泪,nameko 和 eventlet 停止维护后的项目自救,升级和替代之路
python
Flittly9 小时前
【从零手写 ClaudeCode:learn-claude-code 项目实战笔记】(5)Skills (技能加载)
python·agent
敏编程10 小时前
一天一个Python库:pyarrow - 大规模数据处理的利器
python
Flittly11 小时前
【从零手写 ClaudeCode:learn-claude-code 项目实战笔记】(4)Subagents (子智能体)
python·agent
CoovallyAIHub12 小时前
181小时视频丢给GPT-5,准确率只有15%——南大联合NVIDIA等五校发布多模态终身理解数据集
深度学习·算法·计算机视觉
CoovallyAIHub12 小时前
CVPR 2026 | GS-CLIP:3D几何先验+双流视觉融合,零样本工业缺陷检测新SOTA,四大3D工业数据集全面领先!
深度学习·算法·计算机视觉
数据智能老司机16 小时前
PyTorch 深度学习——使用神经网络来拟合数据
pytorch·深度学习