PyMysql error : Packet Sequence Number Wrong - got 1 expected 0

文章目录

我自己知道的,这类问题有两类原因,两种解决方案。

错误一

错误原因

pymysql的主进程启动的connect无法给子进程中使用,所以读取大批量数据时最后容易出现了此类问题。

解决方案

换成pymysql-pool可以解决方法:

具体如下:

shell 复制代码
pip install pymysql-pool

代码如下:

python 复制代码
import pymysql
import pymysqlpool

def select_ebay_catelotory():
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=10, maxsize=20, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT *** """)

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows

错误二

原因

要读取的内容太大了。有两类:某列太长了,总行数太多了。

如何确定?

你的代码读取100行没问题,1000行也没问题,10000行也没问题,100万行就有问题了。那就是这个原因。

解决方案

不要limit去读,太费时间:先取id,再用id去分批读取数据。

python 复制代码
import pymysql
import pymysqlpool

def select_all_ids():
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=35, maxsize=35, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT `id` FROM sfc_minesweeper.product_detail WHERE create_time>'2024-07-10' AND CHAR_LENGTH(result_data)>500""")

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows


def select_ebay_catelotory(pids):
    config={'host': HOST, 'user': USER, 'password': PASSWD, 'database': DB, 'autocommit':True}
    pool1 = pymysqlpool.ConnectionPool(size=35, maxsize=35, pre_create_num=2, name='pool1', **config)
    con1 = pool1.get_connection()
    gcu = con1.cursor()
    try:
        gcu.execute(f"""SELECT `id`, `result_data`, `product_offer_id` FROM sfc_minesweeper.product_detail WHERE id in {tuple(pids)}""")

        # 获取剩余结果所有数据
        rows = gcu.fetchall()
    except Exception as e:
        print(e)
    finally:
        # gcu.close()
        con1.close()
    return rows

# 先拿到所有id
pd_ids = [e[0] for e in select_all_ids()]
# 再分批读取
pd1688s = []
step = 4000
for begin in range(0, len(pd_ids), step):
    pd1688s.extend([e for e in select_ebay_catelotory(pd_ids[begin:begin+step])])
    print(i, len(pd1688s))
相关推荐
TDengine (老段)36 分钟前
基于 TSBS 标准数据集下 TimescaleDB、InfluxDB 与 TDengine 性能对比测试报告
java·大数据·开发语言·数据库·时序数据库·tdengine·iotdb
TDengine (老段)39 分钟前
TDengine 在金融领域的应用
大数据·数据库·物联网·金融·时序数据库·tdengine·涛思数据
标贝科技1 小时前
标贝科技:大模型领域数据标注的重要性与标注类型分享
数据库·人工智能
野木香1 小时前
mysql8常用sql语句
数据库·sql·mysql
hycccccch1 小时前
Redis的IO多路复用
数据库·redis·缓存
不再幻想,脚踏实地1 小时前
Spring Boot配置文件
java·数据库·spring boot
_extraordinary_1 小时前
MySQL 事务(二)
android·数据库·mysql
fmdpenny2 小时前
SQL中联表的运用
数据库·sql
不剪发的Tony老师2 小时前
互联网SQL面试题:用户会话时长分析
数据库·sql
睡觉z2 小时前
Shell编程之正则表达式与文本处理器
数据库·mysql·正则表达式