配置RSUniVLM环境(自用)

首先git clone这个仓库,但是好像不太行,就直接下载下来吧

创个容器弄,容器里需要conda gpu

镜像的话 在dockerhub找到了一个:docker pull vkashyap10/llava-next

下载在了

|------------------------|----------|
| ssh root@10.12.107.240 | amos@123 |

这个机器上。等会看看怎么传到rd调研用的机器上。

复制代码
docker save -o llava-next.tar vkashyap10/llava-next
scp llava-next.tar root@bjrs-acg-tge0209f1a4.bjrs:/ssd2/lixiang/rs/dockerimage
docker load -i /ssd2/lixiang/rs/dockerimage/llava-next.tar

##ok scp用不了 那就用bos吧 上传和下载的命令示例如下
bcecmd bos cp text.txt bos:/mybucket/test.txt
bcecmd bos cp bos:/mybucket/test.txt text.txt

bcecmd bos cp llava-next.tar bos:/aipe-easyedge-model-zoo/tmp/llava-next.tar
bcecmd bos cp bos:/aipe-easyedge-model-zoo/tmp/llava-next.tar llava-next.tar

docker run --name rsunivlm \
    --net=host \
    --privileged \
    --cap-add=SYS_PTRACE --shm-size 5g \
    --gpus all \
    -v /ssd2/lixiang/rs:/ssd2/lixiang/rs \
    -itd \
    vkashyap10/llava-next:latest /bin/bash

docker exec -it rsunivlm bash

运行github上相应的命令去配环境,没碰到什么问题。

需要下checkpoints,在Google Drive上,要外网。。那就还是传到那个能连外网的机子上,再导过来。

复制代码
# 先安装gdown
pip install gdown

# 获取Google drive文件(不能是文件夹)的ID
# 比如这个https://drive.google.com/file/d/12LhpGHvGu4wIgXrONspNKqfGFpTfr0-p/view?usp=drive_link 里面的12LhpGHvGu4wIgXrONspNKqfGFpTfr0-p就是id。



# 在python中运行
>>> import gdown
>>> url = 'https://drive.google.com/uc?id=1Egva7JAYHliVUcqxk5pnFymyNaE3d_B3'
>>> output = 'added_tokens.json'
>>> gdown.download(url, output, quiet=False)

接下来是跑代码环节了。

在容器里装一个icoding的vscode。

复制代码
# 请复制以下命令到开发机上执行(注:如在容器内执行,请在命令后添加-p 8888参数,端口号需与启动容器端口相同)
curl -s http://baidu-ide.bj.bcebos.com/platform/script/host-script/install-agent.sh | bash -s -- -g a040a1ac-d5ad-4198-87ac-6a4353c8feaa -c 2c5c163e616de3b377e19c7bed5767ac -v 1.8.401.83.1.03

# 报错了,然后去宿主机上看,发现是8888端口被占用了。直接把命令改成-p 8889就成功了
相关推荐
Coding茶水间10 小时前
基于深度学习的安检危险品检测系统演示与介绍(YOLOv12/v11/v8/v5模型+Pyqt5界面+训练代码+数据集)
图像处理·人工智能·深度学习·yolo·目标检测·机器学习·计算机视觉
Angelina_Jolie11 小时前
基于 Retinex 的 TempRetinex:适用于不同光照条件下低光视频的无监督增强方法
计算机视觉·音视频
翔云 OCR API12 小时前
承兑汇票识别接口技术解析与应用实践
开发语言·人工智能·python·计算机视觉·ocr
百***074513 小时前
GPT-Image-1.5 极速接入全流程及关键要点
人工智能·gpt·计算机视觉
Doctor_Strange_DML14 小时前
一个简单有效的数据增强技术:data3
人工智能·计算机视觉
棒棒的皮皮15 小时前
【OpenCV】Python图像处理形态学之膨胀
图像处理·python·opencv·计算机视觉
Dev7z15 小时前
YOLO11 公共区域违法发传单检测系统设计与实现
人工智能·计算机视觉·目标跟踪
SickeyLee15 小时前
基于Dify智能体开发平台开发一个目标检测智能体
人工智能·计算机视觉·目标跟踪
肥猪猪爸16 小时前
计算机视觉中的Mask是干啥的
图像处理·人工智能·深度学习·神经网络·目标检测·计算机视觉·视觉检测
格林威18 小时前
双目视觉标定:消除视差误差的7种核心方案,附OpenCV+Halcon实现代码!
人工智能·数码相机·opencv·计算机视觉·视觉检测·制造