Python读取Excel/CSV到MySQL

【1】Python读取CSV到MySQL

python 复制代码
import pandas as pd
from sqlalchemy import create_engine

# 数据库连接参数(请根据你的实际配置修改)
DB_USER = 'root'      # 如 root
DB_PASSWORD = '123456'  # 如 123456
DB_HOST = 'localhost'          # 或 127.0.0.1
DB_PORT = 3306
DB_NAME = 'travel_pmm'

# 构建数据库连接 URL
engine_url = f"mysql+pymysql://{DB_USER}:{DB_PASSWORD}@{DB_HOST}:{DB_PORT}/{DB_NAME}?charset=utf8mb4"

# 创建 SQLAlchemy 引擎
engine = create_engine(engine_url, echo=False)

# 读取 CSV 文件(假设文件在当前目录下)
df = pd.read_csv('trip_fujian_scenic_detail_20260214_155519.csv', encoding='utf-8')

# 可选:查看前几行确保数据正确
print(df.head())
print(df.dtypes)

# 将数据写入 MySQL 表(表名设为 travel_records)
# if_exists: 'fail'(默认), 'replace'(删旧建新), 'append'(追加)
df.to_sql(
    name='trip_fujian_scenic_detail',
    con=engine,
    if_exists='replace',  # 第一次用 replace,后续可用 append
    index=False,          # 不写入 pandas 的索引
    chunksize=1000        # 分批插入,提高性能
)

【2】Python读取xls到MySQL

python 复制代码
import pandas as pd
from sqlalchemy import create_engine

# === 1. 配置 MySQL 连接信息 ===
DB_USER = 'root'      # 如 root
DB_PASSWORD = '123456'  # 如 123456
DB_HOST = 'localhost'
DB_PORT = 3306
DB_NAME = 'travel_pmm'         # 你的数据库名

# 构建连接 URL(注意:charset=utf8mb4 支持 emoji 和中文)
engine_url = f"mysql+pymysql://{DB_USER}:{DB_PASSWORD}@{DB_HOST}:{DB_PORT}/{DB_NAME}?charset=utf8mb4"

# 创建数据库引擎
engine = create_engine(engine_url, echo=False)  # echo=True 可打印 SQL 日志

# === 2. 读取 Excel 文件 ===
# 假设文件名为 data.xlsx,位于当前目录
file_path = '1994-2024年度旅游数据3.xls'

# 读取第一个 sheet(默认)
df = pd.read_excel(file_path, engine='xlrd')
# df = pd.read_excel(file_path, engine='openpyxl')

# 如果要读取特定 sheet,用:
# df = pd.read_excel(file_path, sheet_name='Sheet1', engine='openpyxl')

# 可选:查看数据
print("✅ 数据前5行:")
print(df.head())
print("\n✅ 数据类型:")
print(df.dtypes)

# === 3. 数据清洗(可选但推荐)===
# 示例:去除列名前后空格
df.columns = df.columns.str.strip()

# 示例:处理 NaN 值(MySQL 不喜欢 NaN)
df = df.where(pd.notnull(df), None)  # 将 NaN 转为 None(对应 SQL 的 NULL)

# === 4. 写入 MySQL ===
table_name = 'travel_money_data'  # 目标表名

df.to_sql(
    name=table_name,
    con=engine,
    if_exists='append',   # 'fail'(默认), 'replace'(删表重建), 'append'(追加)
    index=False,          # 不写入 pandas 的行索引
    chunksize=1000,       # 分批插入,提升性能
    method='multi'        # 使用多值插入,加速
)

print(f"\n✅ 成功将 {len(df)} 行数据写入 MySQL 表 `{DB_NAME}.{table_name}`!")

【3】Python读取xlsx到MySQL

python 复制代码
import pandas as pd
from sqlalchemy import create_engine

# === 1. 配置 MySQL 连接信息 ===
DB_USER = 'root'      # 如 root
DB_PASSWORD = '123456'  # 如 123456
DB_HOST = 'localhost'
DB_PORT = 3306
DB_NAME = 'travel_pmm'         # 你的数据库名

# 构建连接 URL(注意:charset=utf8mb4 支持 emoji 和中文)
engine_url = f"mysql+pymysql://{DB_USER}:{DB_PASSWORD}@{DB_HOST}:{DB_PORT}/{DB_NAME}?charset=utf8mb4"

# 创建数据库引擎
engine = create_engine(engine_url, echo=False)  # echo=True 可打印 SQL 日志

# === 2. 读取 Excel 文件 ===
# 假设文件名为 data.xlsx,位于当前目录
file_path = '1994-2024年度旅游数据3.xls'

# 读取第一个 sheet(默认)
df = pd.read_excel(file_path, engine='openpyxl')

# 如果要读取特定 sheet,用:
# df = pd.read_excel(file_path, sheet_name='Sheet1', engine='openpyxl')

# 可选:查看数据
print("✅ 数据前5行:")
print(df.head())
print("\n✅ 数据类型:")
print(df.dtypes)

# === 3. 数据清洗(可选但推荐)===
# 示例:去除列名前后空格
df.columns = df.columns.str.strip()

# 示例:处理 NaN 值(MySQL 不喜欢 NaN)
df = df.where(pd.notnull(df), None)  # 将 NaN 转为 None(对应 SQL 的 NULL)

# === 4. 写入 MySQL ===
table_name = 'travel_money_data'  # 目标表名

df.to_sql(
    name=table_name,
    con=engine,
    if_exists='append',   # 'fail'(默认), 'replace'(删表重建), 'append'(追加)
    index=False,          # 不写入 pandas 的行索引
    chunksize=1000,       # 分批插入,提升性能
    method='multi'        # 使用多值插入,加速
)

print(f"\n✅ 成功将 {len(df)} 行数据写入 MySQL 表 `{DB_NAME}.{table_name}`!")
相关推荐
用户7783366132116 小时前
用 React Hook 封装搜索数据:useSerp 的防抖、缓存与错误处理
python·api
这个DBA有点耶7 小时前
从MySQL 5.7到8.0:JSON查询性能差在哪?虚拟列索引vs多值索引怎么选
数据库·mysql·架构
65岁退休Coder10 小时前
LangGraph v1.2.9 节点容错策略 & 流式输出 & 持久化记忆管理
后端·python·langchain
ikun_文13 小时前
Django框架路由Router的使用
python·pycharm·django
IvanCodes13 小时前
Python 基础语法(二):字符串与常用操作
python
昭昭日月明13 小时前
LangChain 生态:从链到代理,开发者需要掌握的三大核心
python·langchain·agent
Csvn13 小时前
🐍 Day 8:面向对象编程
后端·python
程序员天天困13 小时前
向量检索不准怎么办:混合检索与 Rerank 重排序召回优化实战
后端·python·ai编程
alphaTao14 小时前
LeetCode 每日一题 2026/8/24-2026/8/30
python·算法·leetcode
苏灿烤鱼14 小时前
当 AI Agent 遇见真实科学环境:深度拆解 Scientific Agent Skills,把"聊天机器人"变成"AI 科学家"
python·开源·agent