MySQL实时同步到Elasticsearch实现方案 —— canal(兼容ES5.X)

本文主要是介绍MySQL实时同步到Elasticsearch实现方案 —— canal(兼容ES5.X),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

首先看一下canal的实现原理:

 

 

  • canal 模拟 MySQL slave 的交互协议,伪装自己为 MySQL slave ,向 MySQL master 发送dump 协议
  • MySQL master 收到 dump 请求,开始推送 binary log 给 slave (即 canal )
  • canal 解析 binary log 对象(原始为 byte 流)

怎么使用

这里只记录需要使用过程中需要注意的地方,具体用法不在此赘述,可以参考canal的wiki:https://github.com/alibaba/canal

一、数据库配置:

  • 需要先开启 Binlog 写入功能,配置 binlog-format 为 ROW 模式,my.cnf 中配置如下

log-bin=mysql-bin # 开启 binlog

 

binlog-format=ROW # 选择 ROW 模式 server_id=1 # 配置 MySQL replaction 需要定义,不要和 canal 的 slaveId 重复

  • 授权 canal 链接 MySQL 账号具有作为 MySQL slave 的权限, 如果已有账户可直接 grant

CREATE USER canal IDENTIFIED BY 'canal'

GRANT SELECT, REPLICATION SLAVE, REPLICATION CLIENT ON *.* TO 'canal'@'%';

-- GRANT ALL PRIVILEGES ON *.* TO 'canal'@'%' ;

FLUSH PRIVILEGES;

二、canal server端:

1. conf/canal.properties下修改端口

 

2.  可以配置destinations(默认为example,多个以逗号隔开),这个对应conf下面的文件夹order

 

3. order文件夹中的instance.properties,可以进行消费通道的配置:

 

三、canal client端:

canal 1.1.1版本之后,自带了适配器,不用写任何java代码,只需要写几个SQL脚本就可以直接实现同步,简单同步逻辑的可以考虑使用,比如单表同步、多表简单关联,友情提醒请看文章末尾

canal adapter 的 Elasticsearch 版本支持6.x.x以上,但是目前公司使用的es为5.3.3,官方宣称可以通过更改依赖即可适配低版本的es,但是还有一个地方需要调整,具体改动如下:

  1. 先将client-adapter中elasticsearch下的pom文件中依赖的elasticsearch相关组件的版本号降至5.X
  2. com.alibaba.otter.canal.client.adapter.es.ESAdapter类中

    transportClient.addTransportAddress(new TransportAddress(InetAddress.getByName(host.substring(0, i)),

        Integer.parseInt(host.substring(i + 1))));

    修改成:
     

    transportClient.addTransportAddress(new InetSocketTransportAddress(InetAddress.getByName(host.substring(0, i)),

        Integer.parseInt(host.substring(i + 1))));

    3. 重新编译

    mvn clean install -Dmaven.test.skip -Denv=release

另外在同步SQL上面也有很多限制,下面是官方文档的:

  1. 主表不能为子查询语句
  2. 只能使用left outer join即最左表一定要是主表
  3. 关联从表如果是子查询不能有多张表
  4. 主sql中不能有where查询条件(从表子查询中可以有where条件但是不推荐, 可能会造成数据同步的不一致, 比如修改了where条件中的字段内容)
  5. 关联条件只允许主外键的'='操作不能出现其他常量判断比如: on a.role_id=b.id and b.statues=1
  6. 关联条件必须要有一个字段出现在主查询语句中比如: on a.role_id=b.id 其中的 a.role_id 或者 b.id 必须出现在主select语句中


除此之外,在使用过程中,还发现了一些其它未说明的限制和问题

1. _index只支持索引名称,不支持alias,在索引需要重构修改名称的时候,这里也需要进行修改。

2. 查询语句的字段大小写必须跟数据库中一致,如图中的ORDER_ID,如不指定,不会报错,但是查不出数据。

3. 在某一个表的数据时,会删除整个文档,比如删除了order_payment,那么会整个order_header文档。

5. 更新时查询不支持非数字类型主键,这个是由于拼接SQL字符串导致,已通过修改拼接代码解决。

6. 有一种业务场景,就是修改供应商或者维修厂的名称时,会涉及大量的文档更新,看了下原来的代码的代码中使用了批处理,但是速度奇慢,后续把代码注释掉之后,速度却得到了质的提升,无解。

注意:

对于官方提供的canal adapter,个人建议酌情使用,在非常简单的单表同步或者多表简单关联,可以考虑使用,能够很大程度的节省开发时间

在订单查询优化过程中,早期一直在使用canal adapter,但是因为订单的业务同步关联比较复杂,在对源码进行了多次修改才适配了订单数据的同步,另外,canal adapter在大多数场景下都会进行回表查询,这对同步效率也会有一定的影响。

在后面演示环境的DTS数据订阅处理时,发现有些代码完全可以为测试环境的canal同步所用,考虑到后续同步的灵活性,决定放弃了官方的adapter,自己写一套adapter。

这篇关于MySQL实时同步到Elasticsearch实现方案 —— canal(兼容ES5.X)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1129873

相关文章

MySQL 8 中的一个强大功能 JSON_TABLE示例详解

《MySQL8中的一个强大功能JSON_TABLE示例详解》JSON_TABLE是MySQL8中引入的一个强大功能,它允许用户将JSON数据转换为关系表格式,从而可以更方便地在SQL查询中处理J... 目录基本语法示例示例查询解释应用场景不适用场景1. ‌jsON 数据结构过于复杂或动态变化‌2. ‌性能要

Python实现终端清屏的几种方式详解

《Python实现终端清屏的几种方式详解》在使用Python进行终端交互式编程时,我们经常需要清空当前终端屏幕的内容,本文为大家整理了几种常见的实现方法,有需要的小伙伴可以参考下... 目录方法一:使用 `os` 模块调用系统命令方法二:使用 `subprocess` 模块执行命令方法三:打印多个换行符模拟

SpringBoot+EasyPOI轻松实现Excel和Word导出PDF

《SpringBoot+EasyPOI轻松实现Excel和Word导出PDF》在企业级开发中,将Excel和Word文档导出为PDF是常见需求,本文将结合​​EasyPOI和​​Aspose系列工具实... 目录一、环境准备与依赖配置1.1 方案选型1.2 依赖配置(商业库方案)二、Excel 导出 PDF

Python实现MQTT通信的示例代码

《Python实现MQTT通信的示例代码》本文主要介绍了Python实现MQTT通信的示例代码,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录1. 安装paho-mqtt库‌2. 搭建MQTT代理服务器(Broker)‌‌3. pytho

MySQL字符串常用函数详解

《MySQL字符串常用函数详解》本文给大家介绍MySQL字符串常用函数,本文结合实例代码给大家介绍的非常详细,对大家学习或工作具有一定的参考借鉴价值,需要的朋友参考下吧... 目录mysql字符串常用函数一、获取二、大小写转换三、拼接四、截取五、比较、反转、替换六、去空白、填充MySQL字符串常用函数一、

MySQL中比较运算符的具体使用

《MySQL中比较运算符的具体使用》本文介绍了SQL中常用的符号类型和非符号类型运算符,符号类型运算符包括等于(=)、安全等于(=)、不等于(/!=)、大小比较(,=,,=)等,感兴趣的可以了解一下... 目录符号类型运算符1. 等于运算符=2. 安全等于运算符<=>3. 不等于运算符<>或!=4. 小于运

虚拟机Centos7安装MySQL数据库实践

《虚拟机Centos7安装MySQL数据库实践》用户分享在虚拟机安装MySQL的全过程及常见问题解决方案,包括处理GPG密钥、修改密码策略、配置远程访问权限及防火墙设置,最终通过关闭防火墙和停止Net... 目录安装mysql数据库下载wget命令下载MySQL安装包安装MySQL安装MySQL服务安装完成

使用zip4j实现Java中的ZIP文件加密压缩的操作方法

《使用zip4j实现Java中的ZIP文件加密压缩的操作方法》本文介绍如何通过Maven集成zip4j1.3.2库创建带密码保护的ZIP文件,涵盖依赖配置、代码示例及加密原理,确保数据安全性,感兴趣的... 目录1. zip4j库介绍和版本1.1 zip4j库概述1.2 zip4j的版本演变1.3 zip4

MySQL进行数据库审计的详细步骤和示例代码

《MySQL进行数据库审计的详细步骤和示例代码》数据库审计通过触发器、内置功能及第三方工具记录和监控数据库活动,确保安全、完整与合规,Java代码实现自动化日志记录,整合分析系统提升监控效率,本文给大... 目录一、数据库审计的基本概念二、使用触发器进行数据库审计1. 创建审计表2. 创建触发器三、Java

MySQL逻辑删除与唯一索引冲突解决方案

《MySQL逻辑删除与唯一索引冲突解决方案》本文探讨MySQL逻辑删除与唯一索引冲突问题,提出四种解决方案:复合索引+时间戳、修改唯一字段、历史表、业务层校验,推荐方案1和方案3,适用于不同场景,感兴... 目录问题背景问题复现解决方案解决方案1.复合唯一索引 + 时间戳删除字段解决方案2:删除后修改唯一字