配置RSUniVLM环境(自用)

首先git clone这个仓库,但是好像不太行,就直接下载下来吧

创个容器弄,容器里需要conda gpu

镜像的话 在dockerhub找到了一个:docker pull vkashyap10/llava-next

下载在了

|------------------------|----------|
| ssh root@10.12.107.240 | amos@123 |

这个机器上。等会看看怎么传到rd调研用的机器上。

复制代码
docker save -o llava-next.tar vkashyap10/llava-next
scp llava-next.tar root@bjrs-acg-tge0209f1a4.bjrs:/ssd2/lixiang/rs/dockerimage
docker load -i /ssd2/lixiang/rs/dockerimage/llava-next.tar

##ok scp用不了 那就用bos吧 上传和下载的命令示例如下
bcecmd bos cp text.txt bos:/mybucket/test.txt
bcecmd bos cp bos:/mybucket/test.txt text.txt

bcecmd bos cp llava-next.tar bos:/aipe-easyedge-model-zoo/tmp/llava-next.tar
bcecmd bos cp bos:/aipe-easyedge-model-zoo/tmp/llava-next.tar llava-next.tar

docker run --name rsunivlm \
    --net=host \
    --privileged \
    --cap-add=SYS_PTRACE --shm-size 5g \
    --gpus all \
    -v /ssd2/lixiang/rs:/ssd2/lixiang/rs \
    -itd \
    vkashyap10/llava-next:latest /bin/bash

docker exec -it rsunivlm bash

运行github上相应的命令去配环境,没碰到什么问题。

需要下checkpoints,在Google Drive上,要外网。。那就还是传到那个能连外网的机子上,再导过来。

复制代码
# 先安装gdown
pip install gdown

# 获取Google drive文件(不能是文件夹)的ID
# 比如这个https://drive.google.com/file/d/12LhpGHvGu4wIgXrONspNKqfGFpTfr0-p/view?usp=drive_link 里面的12LhpGHvGu4wIgXrONspNKqfGFpTfr0-p就是id。



# 在python中运行
>>> import gdown
>>> url = 'https://drive.google.com/uc?id=1Egva7JAYHliVUcqxk5pnFymyNaE3d_B3'
>>> output = 'added_tokens.json'
>>> gdown.download(url, output, quiet=False)

接下来是跑代码环节了。

在容器里装一个icoding的vscode。

复制代码
# 请复制以下命令到开发机上执行(注:如在容器内执行,请在命令后添加-p 8888参数,端口号需与启动容器端口相同)
curl -s http://baidu-ide.bj.bcebos.com/platform/script/host-script/install-agent.sh | bash -s -- -g a040a1ac-d5ad-4198-87ac-6a4353c8feaa -c 2c5c163e616de3b377e19c7bed5767ac -v 1.8.401.83.1.03

# 报错了,然后去宿主机上看,发现是8888端口被占用了。直接把命令改成-p 8889就成功了
相关推荐
牧羊人.3331 天前
计算机视觉基础|第2章 OpenCV图像基础操作(读写、窗口、像素操作)
人工智能·opencv·计算机视觉
双翌视觉1 天前
可见光之外的视界,短波红外成像技术能做什么?
人工智能·计算机视觉·视觉检测
春末的南方城市1 天前
消费级显卡迎来实时视频生成!FastVideo 开源 FastWan-QAD,RTX 5090 实现 1.8 秒生成 5 秒 480P 视频!
人工智能·深度学习·计算机视觉·aigc·音视频
满怀冰雪2 天前
19-图像数据处理:PaddleVision Transform 实战
人工智能·深度学习·计算机视觉·paddle
123_不打狼2 天前
零基础到就业:完整计算机视觉系统化学习路线指南
人工智能·学习·计算机视觉
Clipp_Huang2 天前
光学跟踪系统标定
人工智能·计算机视觉·重构·机器视觉
weixin_468466852 天前
目标检测精度上限与影响因素分析
图像处理·人工智能·目标检测·计算机视觉·图像分类·coco·检测精度
sali-tec2 天前
C# 基于OpenCv的视觉工作流-章102-车牌识别
图像处理·人工智能·opencv·计算机视觉
陈嘿萌3 天前
ECCV 2026 | 南开&OPPO开源 ExpoMotion:首个大规模动态多曝光融合数据集
人工智能·计算机视觉·图像融合·南开大学·新数据集·expomotion·多曝光融合
硅谷秋水3 天前
人工智能医疗健康机器人研究综述与分析
人工智能·深度学习·计算机视觉·语言模型·机器人