主RootServer会不断给备RootServer发送lease。被RootServer收到该lease后会保存到几个变量中:
int ObCheckRunnable::renew_lease(const ObLease& lease)
{
int err = OB_SUCCESS;
lease_on_ = true;
lease_time_ = lease.lease_time;
lease_interval_ = lease.lease_interval;
renew_interval_ = lease.renew_interval;
return err;
}

然后备RootServer的CheckRunnable::run()线程中会周期性检查是否需要进行lease续约。RS会检查vip是否与自己的本地ip一致,分为几种情况:

if (rs.ip = vip  && rs.role = slave)
{
vip漂移到了备rs(原因可能是主rs挂掉了)
备rs读取自己的lease状态,如果状态不为invalid则自己进入switching状态。
(如果被发现自己lease已经超时,则认为自己的lease状态为invalid,此时报警,不做切换)
}
if (rs.ip = vip && rs.role = master)
{
vip还在主rs上。属于一般正常情况。什么都不用做。
}
if (rs.ip != vip && rs.role = slave)
{
vip不在备rs上。属于一般正常情况。
这时候检查一下自己的lease状态,如果lease为invalid状态,则进入state变为init状态,重新注册。
如果lease为should renew状态,则renew lease(向vip rs发送renew请求)。
}
if (rs.ip != vip && rs.role = master)
{
异常情况。主rs失去了vip,为了避免损失进一步扩大,主rs立即退出。(思考:这里为什么主rs不把自己切换成备?)
}

这里特别需要注意的是renew lease,它始终是向vip rs发送renew lease请求,而不是向某个具体的rs发送请求。所以rs的lease状态严重依赖于HA。

什么时候需要Renew lease呢?看下面一段代码。仅当lease超过了一个安全区域即将过期的时候才会renew。
// common/ob_check_runnable.cpp

int64_t ObCheckRunnable::get_lease_status_()
{
LeaseStatus status = LEASE_NORMAL;
timeval time_val;
gettimeofday(&time_val, NULL);
int64_t cur_time_us = time_val.tv_sec * 1000 * 1000 + time_val.tv_usec;
if (lease_time_ + lease_interval_ < cur_time_us)
{
TBSYS_LOG(WARN, "Lease expired");
status = LEASE_INVALID;
}
else if (lease_time_ + lease_interval_ < cur_time_us + renew_interval_)
{
TBSYS_LOG(DEBUG, "Lease will expire");
status = LEASE_SHOULD_RENEW;
} return status;
}

下面梳理一次主死掉、备切换成主的过程:

1. 主、备各司其职。主负责具体工作,备通过回放commit log与主保持准同步状态。

2. 主因为某种原因死掉(运维、异常等),HA检测到该事件,立即进行IP切换(把备的IP设置成VIP)

3. 备在CheckRunnable::run()中检测到自己的IP与VIP相等,并且自己当前角色是SLAVE,立即把自己的STATE设置成SWITCH状态。

4. 在run()开始执行之前,主线程(ob_root_worker.cpp)就已经在一个loop里面了:

        while (ObRoleMgr::SWITCHING != role_mgr_.get_state() // lease is valid and vip is mine
&& ObRoleMgr::INIT != role_mgr_.get_state() // lease is invalid, should reregister to master
// but now just let it exit.
&& ObRoleMgr::STOP != role_mgr_.get_state() // stop normally
&& ObRoleMgr::ERROR != role_mgr_.get_state())
{
usleep(10 * 1000); // 10 ms
} if (ObRoleMgr::SWITCHING == role_mgr_.get_state())
{
切换成master:停止log等待线程,停止log重放线程,启动工作线程,等等。
}

小结:

1. 主备切换受HA管理,非异常情况下主备RS不进行切换

2. 备集群SWITCH状态是进入ACTIVE MASTER状态的准备态

相关阅读

OceanBase简史

OceanBase Join操作

OceanBase内部表

OceanBase官网

推荐几本数据库相关的书籍:

数据库系统设计、实现与管理(第8版)
数据库原理与设计
NoSQL数据库入门/图灵程序设计丛书 (日)佐佐木达也|译
深入NoSQL /Shashank Tiwari 著 图灵程序设计丛书
大数据挑战与NoSQL数据库技术(大数据技术的学习指南。突破迷局

几本架构书:

网络.4.4BSD操作系统设计与实现(从系统架构师角度出发)
架构实战(软件架构设计的过程)
网络.ACE技术内幕:深入解析ACE架构设计与实现原理
架构之美/斯宾耐立思,(Diomidis Spinellis)

再来个个性t-shirt:
NoSQL 非结构化数据库/大数据 程序主题T恤/Tshirt 两件包邮

OceanBase中主备Rootserver如何管理切换的更多相关文章

  1. (摘)DataGuard物理standby管理 - 主备切换

    DataGuard物理standby管理 - 主备切换 Dataguard的切换分为两种,switchover和failover. switchover一般用于数据库或硬件升级,这时只需要较短时间中断 ...

  2. f5主备切换演练

    1.准备工作: 1)保证主备机同步 2)备份主备机配置 2.切换:所有操作均在主机 方法1:shutdown主机上联的核心交换机的端口: 此方法在主备切换过程中会丢1个包 方法2:命令行下reboot ...

  3. Postgres主备切换

    主备查询 主备不会自动切换(即需要实现线上环境主数据库宕掉之后,从数据库能够自动切换为主数据库,需要借用第三方软件,例如heartbeat等) (1)如何查看是primary还是standby 方法1 ...

  4. Oracle 11.2.0.4.0 Dataguard部署和日常维护(5)-Datauard 主备切换和故障转移篇

    1. dataguard主备切换   1.1. 查看当前主备库是否具备切换条件 on slave select sequence#,first_time,next_time,archived,appl ...

  5. MySQL主备复制原理、实现及异常处理

    复制概述 MySQL支持三种复制方式:基于行(Row)的复制.基于语句(Statement)的复制和混合类型(Mixed)的复制. 基于语句的复制早在3.23版本中就存在,而基于行的复制方式在5.1版 ...

  6. 在Windows Azure上配置VM主备切换(1)——Linux篇

    对任何一个上线系统来说,高可用设计是不可或缺的一个环节,这样才可以确保应用可以持续.稳定的运行,而不是频繁的掉线.停机.高可用设计的核心思路很简单,就是消除一切单点故障,将单点链路或者节点升级为多点. ...

  7. 测试redis+keepalived实现简单的主备切换【转载】

    转自: 测试redis+keepalived实现简单的主备切换 - Try My Best 尽力而为 - ITeye技术网站http://raising.iteye.com/blog/2311757 ...

  8. 在物理 Data Guard 中对异构主备系统的支持 (文档 ID 1602437.1)

    Data Guard中主数据库与物理备用数据库(Redo Apply)之间可以有什么差别?本说明针对重做应用和 Oracle Data Guard 12 发行版 1 进行了更新.它适用于 Oracle ...

  9. ycache中redis主备功能设计及使用说明

    方案概述: 对于ycache-client,如下图,在一致性hash环上的每个节点都有一个备用的节点.正常情况下slave节点不参与key的分配(冷备).只有当master挂了,ycache clie ...

随机推荐

  1. css 优先级

    css优先级的四大原则: 原则一: 继承不如指定 如果某样式是继承来的永远不如具体指定的优先级高.例子1:CODE:<style type="text/css"> &l ...

  2. 跟我开发NSP(网上查询平台):如何选择开发项目

    我想通过一个真实的项目开发的全过程,记录一下开发过程的点点滴滴,记录一下过程中的前思后想.这个全过程包括,如何选择项目.如何分析项目.如何组织项目开发.如何设计开发流程.如何设计软件的总体架构.如何建 ...

  3. retire

    retire 本来抱着进队的决心迎战,结果在第一试就失利,是能力不足,还是命中注定我不是竞赛的料,一切关于OI的事随着GDOI2016的闭幕而消散-- 今后也许再也不搞OI了,或许会玩一下ACM,现在 ...

  4. Codeforces #345 Div.1

    Codeforces #345 Div.1 打CF有助于提高做题的正确率. Watchmen 题目描述:求欧拉距离等于曼哈顿距离的点对个数. solution 签到题,其实就是求有多少对点在同一行或同 ...

  5. 2014.8.15模拟赛【公主的工作】&&bzoj1046[HAOI2007]上升序列

    bzoj题目是这样的 Description 对于一个给定的S={a1,a2,a3,…,an},若有P={ax1,ax2,ax3,…,axm},满足(x1 < x2 < … < xm ...

  6. 深入理解JavaScript的闭包特性 如何给循环中的对象添加事件(转载)

    原文参考:http://blog.csdn.net/gaoshanwudi/article/details/7355794 初学者经常碰到的,即获取HTML元素集合,循环给元素添加事件.在事件响应函数 ...

  7. 2014 ACM省赛总结

    今年ACM省赛已经过去一个星期左右了,2年的ACM训练是该做个总结了,因为前几日去參加蓝桥杯总决赛,所以没来的及写总结,如今在这小小总结一下吧-- 依晰记得去年省赛时候的样子,如今感觉那时像是个无知的 ...

  8. RMAN备份之非归档模式下的备份

    Backing Up a Database in NOARCHIVELOG Mode:1.Log into RMAN2.Shutdown immediate from RMAN3.Startup mo ...

  9. Java基础笔记-String类

    String 类(被final修饰) 字符串是一种特殊的对象,一旦字符串被初始化就不可以被改变了.(内容不变) 例如: String  s = “abc”; String  s1 = new Stri ...

  10. pagination jquery最简单的分页【无刷新和刷新都通用】

    参数说明 参数名 描述 参数值 maxentries 总条目数                           必选参数,整数 items_per_page 每页显示的条目数            ...