高可用的并行MySQL数据同步及分布式

首先聊聊MySQL的数据分布式，目前最为常用的就是Replication（复制）技术。基于此技术外延开来有很多中架构，分类归结为如下：

1、树状结构（Master，Backup-Master，Slaves）

这种结构是目前Web系统用的最为通用的一种。整个系统有1个写入/更新点，即Master；Master-Backup和Slaves都是Replication的Master从库；多级Slave的原因是为了数据过滤和节省网络资源。

2、环状结构（Master-Master，Slaves）

Dual-Master结构是为了提高写吞吐而提出的，通过提高由原来一台MySQL Master服务器提供写/更新的

单点提高到2个点，从框架结构上来说就能看出此方法的提升。

Dual-Master需要解决的问题：

a）ID冲突问题，即对数据库中唯一ID资源的分配必须是一个统一的地方发出。

解决办法有MySQL自带的auto_increment_increment和auto_increment_offset来实现，通过N个Master来设置auto_increment_offset=N，每一台Master上的auto_increment_increment采用1~N中的任意值，但是不能互相重复。如此一来即可。

id-server: 1

auto_increment_increment=1

auto_increment_offset=2

id-server: 2

auto_increment_increment=2

auto_increment_offset=2

针对id-server1来说，id都是1,3,5这样；id-server2来说，id都是2,4,6这样。如此看似很美好，其实不然。在并发情况下，id-server1上相同的表和在id-server2上的表auto_increment值是不同的，但是又需要相互同步，也就是说如果写入分布不均的情况，就可能存在表中id会是1,3,5,7,8,9,11，etc这样的情况，id资源中间空洞太多。

还有一种解决办法是一个独立的ID发号器。实现ID发号器的办法很多，为了让维护更加的纯粹，我们使用一个MySQL的一张表，Master-slave这种结构的来作为一个发号器server。这样一来流程就变成了先去id发号器服务器获取id，再写入Dual-Master中去。多了一个中间环节，而且此中间环节还是个单点，存在风险。但是思路基本这样，可以通过别的服务，基于一定分布式规则的来并行发号器。

b）更新冲突的问题，一条范围的update语句被两台Master server都给执行了，这个时候数据就和最初设想的不一致了。

c）死锁问题，这个在N（N>=3）个以上的环路Master中，出现异常断开后的服务器的binlog，在极端情况下会被恢复后的N-1个环路中的数据server反复执行。

为了解决Multi-Master中的更新冲突和死锁问题，我的办法是多点Insert，但是只有一个点update这样的结构来解决以上b和c的问题。

以上已经将Replication的常用的两种数据分布架构介绍清楚，下来看看另外一种，即MySQL Cluster。MySQL Cluster在一段时间内，我都认为它是相当的鸡肋，生产环境使用它的几乎没有。因为它在跨IDC和数据存储等资源消耗巨大。

MySQL Cluster依赖的两个核心资源就是网络带宽和内存（share nothing和高一致性）。同IDC内的网络带宽还很容易达到百兆或者更高，但是跨IDC的VPN或者专线，要达到这样的速度还是有些困难。数据全部存在内存中，这在小数据时感受不明显，但是对于爆炸式的信息增长来说未免很容易产生瓶颈。虽然新版的Cluster支持将数据写到硬盘，实际速度还有待观察。

Replication基本能够满足可用的需求，但是MySQL的binlog是一个单线程的，这就会在数据同步方面产生瓶颈。一般的做法是通过写一个plugin，来提高并发能力；这个plugin既要满足性能，有要高可用。采用以下方式，通过将一些并行的App绑定在MySQL Cluster Queue上来执行，利用MySQL Cluster自身的高一致性，高可用的特点，存储消息。

如此可以既能满足数据分布式，又能满足并行数据同步。

高可用的并行MySQL数据同步及分布式的更多相关文章

MySQL性能调优与架构设计——第 18 章高可用设计之 MySQL 监控
第 18 章高可用设计之 MySQL 监控前言: 一个经过高可用可扩展设计的 MySQL 数据库集群,如果没有一个足够精细足够强大的监控系统,同样可能会让之前在高可用设计方面所做的努力功亏一篑.一 ...
Mysql数据同步Elasticsearch方案总结
Mysql数据同步Elasticsearch方案总结 https://my.oschina.net/u/4000872/blog/2252620
几篇关于MySQL数据同步到Elasticsearch的文章---第一篇：Debezium实现Mysql到Elasticsearch高效实时同步
文章转载自: https://mp.weixin.qq.com/s?__biz=MzI2NDY1MTA3OQ==&mid=2247484358&idx=1&sn=3a78347 ...
MySQL的高可用实现：MySQL系列之十四
MySQL的高可以有三种实现方式:多主模式(Multi Master MySQL),MHA(Master High Availability)和 Galera Cluster:wresp 一.MHA ...
MySQL高可用架构：mysql+keepalived实现
系统环境及架构 #主机名系统版本 mysql版本 ip地址 mysqlMaster <a href="https://www.linuxprobe.com/" title= ...
超详细干货！Docker+PXC+Haproxy搭建高可用强一致性的MySQL集群
前言干货又来了,全程无废话,可先看目录了解. MySQL搭建集群最常见的是binlog方式,但还有一种方式是强一致性的,能保证集群节点的数据一定能够同步成功,这种方式就是pxc,本篇就使用图文方式一 ...
ProxySQL Cluster 高可用集群 + MySQL MGR环境部署 (多写模式) 部署记录
文章转载自:https://blog.51cto.com/u_6215974/4937192 ProxySQL 在早期版本若需要做高可用,需要搭建两个实例,进行冗余.但两个ProxySQL实例之间的数 ...
高可用(vrrp)以及mysql主主备份部署
高可用说起来感觉很高大上,我刚接触的时候也是一头雾水,但是需求的时候很容易理解的,当一台服务器挂了另一台能够马上顶上去继续提供服务,这就叫做高可用,需求其实不难理解,只是需要自身根据项目的实际需求还有 ...
Elasticsearch和mysql数据同步（elasticsearch-jdbc）
1.介绍对mysql.oracle等数据库数据进行同步到ES有三种做法:一个是通过elasticsearch提供的API进行增删改查,一个就是通过中间件进行数据全量.增量的数据同步,另一个是通过收集 ...

随机推荐

Visual Studio 2015的安装和简单的测试
首先是Visual Studio 2015的安装 Visual Studio是微软开发的一套基于组件的软件开发工具,目前最新的版本是2015. 在 I Tell you 网站下载Visual Stud ...
课堂Beta发布
项目组名:奋斗吧兄弟小组成员:黄兴,李俞寰,栾骄阳,王东涵,杜桥今天6个小组在课上进行了Bate发布,以下是我的一些看法: 飞天小女警的礼物挑选系统: 由于是第一个Bate发布的项目,所以我印象较 ...
【壹拾壹周】final用户调查
组名: 新蜂组长: 武志远组员: 宫成荣谢孝淼杨柳李峤项目名称:java俄罗斯方块NEO 问卷星由宫成荣同学发布: 温馨提示:点击右键,在新标签中打开图片,单击图片即可放大.或者使用按住ctrl ...
[菜鸟]HTTP 与 HTTPS 的区别
HTTP 与 HTTPS 的区别分类编程技术基本概念 HTTP(HyperText Transfer Protocol:超文本传输协议)是一种用于分布式.协作式和超媒体信息系统的应用层协议. 简 ...
2017全球GDP总量达74万亿美元各国占比排行榜
全球GDP总量达74万亿美元各国占比排行榜 2017年公布的2015年全球各国GDP占比,数据图片来源:世界银行报告 2月24日,来自世界银行的最新GDP数字已于2月早些时候公布,现由How ...
mybatis 注解和xml 优缺点
xml: 增加了xml文件,修改麻烦,条件不确定(ifelse判断),容易出错,特殊转义字符比如大于小于注释: 复杂sql不好用,搜集sql不方便,管理不方便,修改需重新编译 #和$区别: 相同都 ...
Influxdb安装部署
1.下载Influxdb并解压 2.下载上图中的nssm(辅助性工具) 3. 在安装目录执行cmd 输入 nssm install influxdb,其中Path选择安装文件中的influxd,Ar ...
【Revit API】创建共享参数
话不多说,直接上代码 var app = doc.Application; app.SharedParametersFilename = sharedParamFilePath; Definition ...
【树状数组套主席树】带修改区间K大数
P2617 Dynamic Rankings 题目描述给定一个含有n个数的序列a[1],a[2],a[3]……a[n],程序必须回答这样的询问:对于给定的i,j,k,在a[i],a[i+1],a[i+ ...
KEIL5.25生成.bin文件步骤
添加.bin文件转换工具 KEIL5的自带.bin文件转化工具在安装目录下:我的安装目录是C盘即,C:\Keil_v5\ARM\ARMCC\bin\fromelf.exe 添加格式为:[C:\Keil ...

高可用的并行MySQL数据同步及分布式

高可用的并行MySQL数据同步及分布式的更多相关文章

随机推荐

热门专题