在昇腾910B服务上部署搭建适配PDF解析工具Mineru2.5开源项目

在昇腾910B服务上部署搭建适配PDF解析工具Mineru2.5开源项目

文章目录


一、在昇腾社区下载适用的mindie镜像并运行容器

昇腾社区

powershell 复制代码
docker run -itd \
  --shm-size=500g \
  --net=host \
  --privileged \
  --name mindie \
  --restart=always \
  --device=/dev/davinci4 \
  --device=/dev/davinci5 \
  --device=/dev/davinci_manager \
  --device=/dev/devmm_svm \
  --device=/dev/hisi_hdc \
  -v /usr/local/Ascend/driver/:/usr/local/Ascend/driver/ \
  -v /usr/local/Ascend/add-ons/:/usr/local/Ascend/add-ons/ \
  -v /usr/local/sbin/:/usr/local/sbin/ \
  -v /var/log/npu/slog/:/var/log/npu/slog \
  -v /var/log/npu/profiling/:/var/log/npu/profiling \
  -v /var/log/npu/dump/:/var/log/npu/dump \
  -v /var/log/npu/:/usr/slog \
  -v /etc/hccn.conf:/etc/hccn.conf \
  swr.cn-south-1.myhuaweicloud.com/ascendhub/mindie:2.0.RC1-800I-A2-py311-openeuler24.03-lts \
  /bin/bash

二、安装系统运行所需要的依赖

进入容器并执行

powershell 复制代码
yum install -y mesa-libGL mesa-libGL-devel libXrender libSM libXext tesseract tesseract-langpack-chi_sim

三、安装mineru所需python依赖并设置环境变量

由博主多次测试失败找到的版本号

报错列举一下

1、报错一

operator torchvision::nms does not exist

是这个torchvision和torch没有对应的结果

2、报错二

ERR00100 PTA call acl api failed

Error\]: The internal ACL of the system is incorrect. Rectify the fault based on the error information in the ascend log. EC0010: Failed to import Python module \[AttributeError: `np.float_` was removed in the NumPy 2.0 release. Use `np.float64` instead...\]. 这个是昇腾软件栈与NumPy 2.0不兼容 ##### 3、报错三 An error happened while trying to locate the files on the Hub and we cannot find the appropriate snapshot folder for the specified revision on the local disk. Please check your internet connection and try again. 这个是必需配置本地模型:export MINERU_MODEL_SOURCE=local ##### 4、报错四 ImportError: /usr/local/lib64/python3.11/site-packages/torch_npu/lib/libtorch_npu.so: undefined symbol: _ZNK5torch8autograd4Node4nameEv 这个是torch和torch_npu版本不匹配 [安装版本](https://gitee.com/ascend/pytorch/releases/tag/v7.1.0.2-pytorch2.5.1) ```powershell pip install torchvision==0.20.1 numpy==1.26.4 torch==2.5.1 accelerate==1.10.1 pip install torch_npu-2.5.1.post3-cp311-cp311-manylinux_2_17_aarch64.manylinux2014_aarch64.whl ``` 环境变量设置 ```powershell export MINERU_MODEL_SOURCE=local export HF_ENDPOINT=https://hf-mirror.com ``` #### 四、部署Mineru项目 core 模块是 MinerU 的核心依赖,包含了除vllm外的所有功能模块。安装此模块可以确保 MinerU 的基本功能正常运行 ```powershell pip install mineru[core] ``` 下载模型 ```powershell mineru-models-download ``` 下载源选择modelscope NPU支持跑pipeline #### 五、运行测试 mineru-gradio --device npu --server-name 0.0.0.0 --server-port 7860 ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/f2108302b0264f1c8eff4e18d0710f78.png) ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/53e257811a4744c9b6edc611a4d7d77d.png) ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/099003cad6ef4a478afc4b1037e20c65.png)

相关推荐
小程故事多_806 小时前
攻克RAG系统最后一公里 图文混排PDF解析的挑战与实战方案
人工智能·架构·pdf·aigc
Mr.LJie16 小时前
记录使用iText7合并PDF文件、PDF发票、PDF火车票
java·pdf
wwwlyj12332118 小时前
劳特巴赫 设置pdf
pdf
Arenaschi2 天前
关于垃圾的CSDN
java·网络·chrome·笔记·其他·oracle·pdf
开开心心就好2 天前
内存清理工具开源免费,自动优化清理项
linux·运维·服务器·python·django·pdf·1024程序员节
开开心心_Every2 天前
图片批量压缩工具:支持有损无损两种模式
python·游戏·微信·django·pdf·excel·语音识别
Charlie_lll2 天前
LibreOffice 实现 Word 转 PDF
java·spring boot·pdf·word
Java后端的Ai之路2 天前
【AI大模型开发】-基于向量数据库的PDF智能问答系统(实战)
人工智能·pdf·向量数据库·智能问答系统
zhangfeng11333 天前
[图书推荐]1000本电子书的开源项目 pdf
pdf
SunnyDays10113 天前
Java 旋转 PDF 页面完整指南(含示例)
java·pdf·pdf页面旋转·旋转pdf页面