PyMysql error : Packet Sequence Number Wrong - got 1 expected 0

文章目录

我自己知道的,这类问题有两类原因,两种解决方案。

错误一

错误原因

pymysql的主进程启动的connect无法给子进程中使用,所以读取大批量数据时最后容易出现了此类问题。

解决方案

换成pymysql-pool可以解决方法:

具体如下:

shell 复制代码
pip install pymysql-pool

代码如下:

python 复制代码
import pymysql
import pymysqlpool

def select_ebay_catelotory():
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=10, maxsize=20, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT *** """)

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows

错误二

原因

要读取的内容太大了。有两类:某列太长了,总行数太多了。

如何确定?

你的代码读取100行没问题,1000行也没问题,10000行也没问题,100万行就有问题了。那就是这个原因。

解决方案

不要limit去读,太费时间:先取id,再用id去分批读取数据。

python 复制代码
import pymysql
import pymysqlpool

def select_all_ids():
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=35, maxsize=35, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT `id` FROM sfc_minesweeper.product_detail WHERE create_time>'2024-07-10' AND CHAR_LENGTH(result_data)>500""")

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows


def select_ebay_catelotory(pids):
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=35, maxsize=35, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT `id`, `result_data`, `product_offer_id` FROM sfc_minesweeper.product_detail WHERE id in {tuple(pids)}""")

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows

# 先拿到所有id
pd_ids = [e[0] for e in select_all_ids()]
# 再分批读取
pd1688s = []
step = 4000
for begin in range(0, len(pd_ids), step):
    pd1688s.extend([e for e in select_ebay_catelotory(pd_ids[begin:begin+step])])
    print(i, len(pd1688s))
相关推荐
东风破_4 小时前
danci 2:创建的单词书到底存在哪里?从 Supabase 一路理解 ORM、Drizzle 和 RLS
数据库·后端·node.js
橙子家5 小时前
OSS 文件上传的几个风险点和解决方案
数据库
2601_962066497 小时前
【Sql Server】Update中的From语句,以及常见更新操作方式
android·java·数据库
愤怒的苹果ext7 小时前
MySQL Shell备份恢复数据库
数据库·mysql·备份恢复·mysqlsh
数字新视界9 小时前
DCIM管理系统的技术架构与部署模式详解
数据库·物联网·数据中心·数据中心基础设施管理·dcim管理系统
何以解忧,唯有..9 小时前
Pydantic 介绍与使用:Python 数据校验的现代方案
数据库·python·microsoft
这个DBA有点耶11 小时前
数据库容灾进入“秒级时代”:同城双活架构原理、关键技术选型与落地实践
数据库·架构·dba
2601_9620748111 小时前
大数据-264 实时数仓 - Canal MySQL的binlog研究 存储目录 变动信息 配置MySQL
大数据·数据库·mysql
2601_9620738111 小时前
大数据-240 离线数仓 - 广告业务 测试 ADS层数据加载 DataX数据导出到 MySQL
大数据·数据库·mysql
Frank_refuel12 小时前
【MYSQL进阶】-> 索引理解
数据库