使用极限网关助力 ES 集群无缝升级、迁移上/下云

在工作中大家可能会遇到以下这些场景：

自建 ES 集群需要平滑迁移到 XX 云；
从 XX 云将 ES 集群迁移到自建机房；
ES 集群进行跨版本升级，同时保留回退能力；

这些场景往往都还有个共同的需求：迁移过程要保证业务的最小停机时间。

幸运的是，在这三个场景中，我们都能使用极限网关来帮助我们进行更丝滑的迁移或升级。下面，我们以迁移 ES 集群上云为例，介绍下整个工作过程。

自建版本： 5.4.2
云上版本： 5.6.16
Gateway 和 Console 建议用最新版本

迁移架构

通过将应用端流量走网关的方式，请求同步转发给自建 ES，网关记录所有的写入请求，并确保顺序在 XX 云 ES 上重放请求，两侧集群的各种故障都妥善进行了处理，从而实现透明的集群双写，实现安全无缝的数据迁移。

业务端如果已经部署在云上，可以使用云上的 SLB 服务来访问网关，确保后端网关的高可用，如果业务端和极限网关还在企业内网，可以使用极限网关自带的 4 层浮动 IP 来确保网关的高可用。

执行步骤

部署 INFINI Gateway

为了保证数据的无缝透明迁移，通过网关来进行双写。

系统调优
安装 INFINI Gateway
修改网关配置

在此下载网关双写配置，默认网关会加载配置文件 gateway.yml 。如果要指定其他配置文件使用 -config 选项。

配置文件内容较多，下面仅展示必要部分。

#primary
PRIMARY_ENDPOINT: http://192.168.56.3:7171
PRIMARY_USERNAME: elastic
PRIMARY_PASSWORD: password
PRIMARY_MAX_QPS_PER_NODE: 10000
PRIMARY_MAX_BYTES_PER_NODE: 104857600 #100MB/s
PRIMARY_MAX_CONNECTION_PER_NODE: 200
PRIMARY_DISCOVERY_ENABLED: false
PRIMARY_DISCOVERY_REFRESH_ENABLED: false
#backup
BACKUP_ENDPOINT: http://192.168.56.3:9200
BACKUP_USERNAME: admin
BACKUP_PASSWORD: admin
BACKUP_MAX_QPS_PER_NODE: 10000
BACKUP_MAX_BYTES_PER_NODE: 104857600 #100MB/s
BACKUP_MAX_CONNECTION_PER_NODE: 200
BACKUP_DISCOVERY_ENABLED: false
BACKUP_DISCOVERY_REFRESH_ENABLED: false

PRIMARY_ENDPOINT ：配置主集群地址和端口
PRIMARY_USERNAME、PRIMARY_PASSWORD : 访问主集群的用户信息
BACKUP_ENDPOINT ：配置备集群地址和端口
BACKUP_USERNAME、BACKUP_PASSWORD: 访问备集群的用户信息

启动网关
启动网关并指定刚刚创建的配置，如下：
./gateway-linux-amd64 -config replication_via-disk.yml.yml

部署 INFINI Console

为了方便在多个集群之间快速切换，管理网关消费任务、查看队列等。使用 INFINI Console 来进行管理。

下载安装
启动服务
./console-linux-amd64 -service install
./console-linux-amd64 -service start
注册资源

将 ES 集群、极限网关都注册到 Console 中。
- 注册 ES 集群：方便切换集群，执行命令。除了新旧集群外，将网关也在此注册一次，方便验证网关功能。
- 注册 Gateway：管理网关任务、队列。

测试 INFINI Gateway

为了验证网关是否正常工作，我们通过 INFINI Console 来快速验证一下。

首先通过走网关的接口来创建一个索引，并写入一个文档，如下：

查看 5.4.2 集群的数据情况，如下：

查看集群 5.6.16 的数据情况，如下：

数据一致，说明网关配置都正常，验证结束。

调整网关的消费策略

因为我们需要在全量数据迁移之后，才能进行增量数据的追加，在全量数据迁移完成之前，我们应该暂停增量数据的消费。修改网关配置里面 Pipeline consume-queue_backup-bulk_request_ingestion-to-backup的参数 auto_start为 false，表示不自动启动该任务，具体配置方法如下：