3、主从复制实现同步数据过滤

在 MySQL 8 主从复制中,指定数据库同步 有两种方案:主库过滤(binlog-do-db)从库过滤(replicate-do-db / replicate-wild-*)推荐在从库配置,更灵活、更安全。

一、核心参数说明

1. 主库(Master)过滤(不推荐)

在主库 my.cnf / my.ini [mysqld] 下配置:

TOML 复制代码
# 只将以下库的变更写入 binlog
binlog-do-db = db1
binlog-do-db = db2

# 不写入 binlog(黑名单)
binlog-ignore-db = mysql
binlog-ignore-db = test
  • 缺点
    • 一旦设置,所有从库都只能同步这几个库,不灵活
    • 依赖 USE 数据库 上下文,跨库语句容易漏同步
    • 主库 binlog 不完整,无法用于全量恢复

2. 从库(Replica)过滤(推荐)

在从库 my.cnf [mysqld] 下配置:

TOML 复制代码
# 白名单:只同步这些库
replicate-do-db = db1
replicate-do-db = db2

# 黑名单:不同步这些库
replicate-ignore-db = mysql
replicate-ignore-db = test

# 通配符(推荐):同步 db_ 开头的所有库
replicate-wild-do-table = db\_%.*
# 忽略 log_ 开头的所有表
replicate-wild-ignore-table = %.log\_%
  • 优点
    • 每个从库可独立控制同步范围
    • replicate-wild-* 支持通配符,不受 USE 影响
    • 主库保留完整 binlog,可恢复

⚠️ 注意:

  • replicate-do-dbROW 模式下按表所属库判断,较可靠
  • MySQL 8.0.26+ 已弃用部分库级过滤,优先用表级通配符

二、完整配置步骤(推荐:从库过滤 + GTID)

1. 主库配置(my.cnf)

TOML 复制代码
[mysqld]
server-id = 1                  # 必须唯一
log-bin = mysql-bin            # 开启 binlog
binlog-format = ROW            # 强烈推荐 ROW 模式
gtid_mode = ON
enforce_gtid_consistency = ON
sync_binlog = 1
binlog_expire_logs_seconds = 864000  # 日志自动清理

重启主库

Bash 复制代码
systemctl restart mysqld

2. 主库创建复制账号

SQL 复制代码
CREATE USER 'repl'@'192.168.1.%' IDENTIFIED WITH mysql_native_password BY 'Repl@123';
GRANT REPLICATION SLAVE ON *.* TO 'repl'@'192.168.1.%';
FLUSH PRIVILEGES;

3. 从库配置(my.cnf)

TOML 复制代码
[mysqld]
server-id = 2                  # 必须不同
read_only = 1
super_read_only = 1
relay-log = relay-bin
gtid_mode = ON
enforce_gtid_consistency = ON

# ========== 关键:指定同步库 ==========
# 方案A:精确库名
# replicate-do-db = order_db
# replicate-do-db = user_db

# 方案B:通配符(推荐)
replicate-wild-do-table = order\_%.*   # 同步 order_ 开头的所有库
replicate-wild-do-table = user\_%.*
replicate-wild-ignore-table = %.%_log  # 忽略所有以 _log 结尾的表

重启从库

Bash 复制代码
systemctl restart mysqld

4. 从库建立主从关系(GTID 模式)

SQL 复制代码
STOP REPLICA;

CHANGE REPLICATION SOURCE TO
  SOURCE_HOST='192.168.1.100',
  SOURCE_USER='repl',
  SOURCE_PASSWORD='Repl@123',
  SOURCE_AUTO_POSITION=1;  -- GTID 自动定位

START REPLICA;

5. 验证

SQL 复制代码
SHOW REPLICA STATUS\G
  • 查看 Slave_IO_RunningSlave_SQL_Running 均为 Yes
  • 查看 Replicate_Do_DBReplicate_Wild_Do_Table 是否已加载

三、动态修改过滤规则(无需重启)

MySQL 8 支持在线修改:

SQL 复制代码
STOP REPLICA;

-- 只同步 db1、db2
CHANGE REPLICATION FILTER
  REPLICATE_DO_DB = (db1, db2),
  REPLICATE_WILD_IGNORE_TABLE = (db1.%_log);

START REPLICA;

查看规则:

SQL 复制代码
SHOW VARIABLES LIKE '%replicate%';

四、常见坑与最佳实践

  1. 不要混用主库 + 从库过滤
    1. 主库 binlog-do-db + 从库 replicate-do-db 容易出现"双重过滤"导致数据丢失
  2. 跨库语句问题
    1. USE db1; INSERT INTO db2.tbl VALUES(...);
    2. 库级过滤replicate-do-db):只看当前库 db1,可能误判
    3. 表级通配符replicate-wild-do-table=db2.*):稳定生效
  3. 推荐组合
    1. binlog_format = ROW replicate-wild-do-table = 目标库.* replicate-wild-ignore-table = %.日志表

五、总结

  • 主库过滤 :简单但不灵活,不推荐
  • 从库库级过滤replicate-do-db,简单场景可用
  • 从库通配符(首选)replicate-wild-do-table稳定、灵活、不受跨库影响
相关推荐
荀彧原名苟或7 分钟前
SAP 执行 CMD命令(GUI_EXEC 执行电脑本机命令、SXPG_COMMAND_EXECUTE函数执行服务器上的外部程序)<转载>
运维·服务器·sap·abap
帷幕落秋12 分钟前
Nginx 系列实战(三):LNMP 完整搭建,动静分离的学习总结
运维·自动化运维
Jae den13 分钟前
服务器 CPU 核心越多越好吗?
运维·服务器
先吃饱再说13 分钟前
从本地跑通到公网访问:前后端项目部署实战
运维·全栈
帷幕落秋16 分钟前
一文吃透 Nginx 虚拟主机:原理 + 双站点实战 + SELinux 排错
运维·自动化运维
mengge.cloud18 分钟前
0909华为云网络类服务实践小白实验教程
linux·运维·服务器·网络·华为云·php
小诗懂技术18 分钟前
从零手写一个 C 语言 HTTP 商品查询服务器:全链路技术实践
linux·服务器·网络
Escalating_xu19 分钟前
【Linux mmap 文件映射】从虚拟地址到页缓存:读写文件、匿名映射与极简 malloc
linux·缓存
智恒百亿20 分钟前
CSDN 文章|八卡 RTX5090 服务器深度实测:256GB 显存池,能否流畅跑通 70B 大模型微调?
运维·服务器
Zixhy26 分钟前
Boost 库实现异步高并发服务器
linux·服务器·c++