耗时3小时,把这两天做好的爬虫程序,用Python封装成exe文件

先执行命令如下:

bash 复制代码
pip install pyinstaller
py -m PyInstaller --log-level=DEBUG --add-data "config.ini;." nmpa_gui.py

很快在dist目录下就有生成一个nmpa_gui文件夹,运行 nmpa_gui.exe,报错:

1️⃣初始化爬虫...

程序执行出错: 'database'

解决办法:需要把config文件(数据库配置信息)拷贝一份到nmpa_gui文件夹下。继续报错:

2️⃣初始化爬虫...

程序执行出错: No localization support for language 'eng'

解决办法:手动复制 locales 文件夹到项目目录并打包(简单直接)

找到你当前环境中安装的 MySQL Connector 的 locales 文件夹:

默认路径为:

bash 复制代码
C:\Users\<你的用户名>\AppData\Roaming\Python\Python311\site-packages\mysql\connector\locales

依旧报错:

3️⃣初始化爬虫...

程序执行出错: Authentication plugin 'mysql_native_password' is not supported

将 _mysql_connector.pyd 复制到项目目录,文件源路径在

bash 复制代码
C:\Users\<你的用户名>\AppData\Roaming\Python\Python311\site-packages

建议在你的项目根目录下创建一个文件夹,比如 internal_libs/,然后把 _mysql_connector.pyd 放进去,另外还需新建文件夹dlls,将libmysql.dll 拷贝到下面。

同时修改.spec文件,主要是 binaries,datas,hiddenimports 这三处:

javascript 复制代码
# -*- mode: python ; coding: utf-8 -*-

import os
from PyInstaller.utils.hooks import collect_data_files

# 收集 mysql connector 的语言资源(eng)
mysql_locales = collect_data_files('mysql.connector', subdir='locales')

block_cipher = None

a = Analysis(
    ['nmpa_gui.py'],
    pathex=[os.path.abspath(".")],
    binaries=[
        ('internal_libs\\_mysql_connector.cp311-win_amd64.pyd', '.'),
        ('dlls\\libmysql.dll', '.')  # 添加 libmysql.dll 支持
    ],
    datas=[
        ('config.ini', '.'),
        ('locales', 'mysql\\connector\\locales')
    ] + mysql_locales,
    hiddenimports=[
        'mysql.connector.authentication',
        'mysql.connector.locales.eng.client_error',
        'mysql.connector.connection_cext',
        'mysql.connector.plugins.mysql_native_password',  # ⬅️ 关键:显式导入认证插件
    ],
    hookspath=[],
    hooksconfig={},
    runtime_hooks=[],
    excludes=[],
    noarchive=False,
    optimize=0,
)

pyz = PYZ(a.pure, a.zipped_data, cipher=block_cipher)

exe = EXE(
    pyz,
    a.scripts,
    [],
    exclude_binaries=True,
    name='nmpa_gui',
    debug=False,
    bootloader_ignore_signals=False,
    strip=False,
    upx=True,
    console=True,  # 保持控制台输出便于调试认证问题
    disable_windowed_traceback=True,
    argv_emulation=False,
)

coll = COLLECT(
    exe,
    a.binaries,
    a.zipfiles,
    a.datas,
    strip=False,
    upx=True,
    upx_exclude=[],
    name='nmpa_gui',
    clean=True,
)

对了,每次重新打包前,建议先清一下缓存,bat命令如下:

bash 复制代码
@echo off
echo 正在清理 PyInstaller 缓存...
rmdir /s /q build dist __pycache__ __pyinstaller
del /q *.pyc *.pyo *.spec
echo 清理完成。

最终使用如下打包命令:

bash 复制代码
py -m PyInstaller --noconfirm nmpa_gui.spec

至此,顺利打包成功并成功运行!

怎么样,看着是不是瞬间就高大上一些了,Python真是利器!!!后续可以再放出来一些配置,比如一批抓取多少页后休息,每插入一页后休息多久,一批完成后休息多久等等!

P.S.因为Cursor又到期了,这点小问题,懒得再去麻烦他, 这次打包中遇到的错误,尤其是困扰比较久的问题3️⃣,最终在阿里通义灵码的技术支持下,得以解决,在此表示感谢,隔壁那位CODEBUDDY和大傻子差不多!

相关推荐
陈敬雷-充电了么-CEO兼CTO14 分钟前
复杂任务攻坚:多模态大模型推理技术从 CoT 数据到 RL 优化的突破之路
人工智能·python·神经网络·自然语言处理·chatgpt·aigc·智能体
YOLO大师39 分钟前
华为OD机试 2025B卷 - 小明减肥(C++&Python&JAVA&JS&C语言)
c++·python·华为od·华为od机试·华为od2025b卷·华为机试2025b卷·华为od机试2025b卷
xiao5kou4chang6kai41 小时前
【Python-GEE】如何利用Landsat时间序列影像通过调和回归方法提取农作物特征并进行分类
python·gee·森林监测·洪涝灾害·干旱评估·植被变化
kaikaile19951 小时前
使用Python进行数据可视化的初学者指南
开发语言·python·信息可视化
Par@ish1 小时前
【网络安全】恶意 Python 包“psslib”仿冒 passlib,可导致 Windows 系统关闭
windows·python·web安全
意疏1 小时前
【Python篇】PyCharm 安装与基础配置指南
开发语言·python·pycharm
冬天给予的预感3 小时前
DAY 54 Inception网络及其思考
网络·python·深度学习
钢铁男儿3 小时前
PyQt5高级界而控件(容器:装载更多的控件QDockWidget)
数据库·python·qt
亿牛云爬虫专家7 小时前
Kubernetes下的分布式采集系统设计与实战:趋势监测失效引发的架构进化
分布式·python·架构·kubernetes·爬虫代理·监测·采集
蹦蹦跳跳真可爱58911 小时前
Python----OpenCV(图像増强——高通滤波(索贝尔算子、沙尔算子、拉普拉斯算子),图像浮雕与特效处理)
人工智能·python·opencv·计算机视觉