大数据学习（03）——HDFS的高可用

别样风景天 2024-09-05 20:21:04 原文

高可用架构图

先上一张搜索来的图。

如上图，HDFS的高可用其实就是NameNode的高可用。

上一篇里，SecondaryNameNode是NameNode单节点部署才会有的角色，它只帮助NameNode完成日志合并的工作，在NameNode出现问题时不能顶上去。

在高可用里，不再有SecondaryNameNode这个角色，Hadoop2.x版本支持NameNode的一主一备，3.x版本支持一主多备，由备机完成日志合并任务。某个时点只有主NameNode对外提供服务。

总结一下，在一个高可用的HDFS集群里，至少需要这么几个角色：

DataNode，存数据的节点，没它就不能叫文件系统了
NameNode，有两个或多个，主节点状态是Active，备节点状态是Standby，备节点来同步、合并、推送主节点的FsImage
共享存储，存放的是主节点的实时日志，备节点从共享存储里异步同步日志，官方有QJM和NFS两种实现

为了实现NameNode的自动切换，还需要这两个角色：

Zookeeper，分布式协调器，NameNode选主用的
ZKFS，Zookeeper客户端，监控NameNode状态，并与Zookeeper保持长连接，与NameNode在一台机器上部署

高可用原理

它的高可用步骤如下：

在配置文件中配置多个NameNode属于同一个cluster，启动hdfs后，NameNode通过zookeeper选主
客户端通过dfs.client.failover.proxy.provider.[clusterID]配置的策略去访问NameNode，通常是向所有的NameNode发送请求来判断哪个是主节点
客户端对主NameNode发起的操作会同步写入共享存储，这里不直接写入其他NameNode是为了避免由于NameNode故障引起响应超时
DataNode把文件的Block信息发送给所有的NameNode
备NameNode按照时间间隔或者日志文件大小来合并主NameNode的FsImage
如果主节点的NameNode或者ZKFS挂了
1. 如果主NameNode挂了，本机的ZKFS会将ZK集群的锁释放，并回调其他ZKFS的方法，通知它们来拿锁。拿到锁的ZKFS连接一下原来的主NameNode，发现确实挂了，再把本机的NameNode状态由Standby修改为Active。
2. 如果ZKFS挂了，ZKFS与ZK的TCP连接会断掉。ZK集群将删除该ZKFS持有的锁，并回调其他ZKFS的方法，通知它们来拿锁。拿到锁的ZKFS连接一下原来的主NameNode，发现它还活着，ZKFS先把原来的主NameNode降级为Standby，再把本机的NameNode升为Active。

高可用环境搭建

Hadoop的官方文档讲的很详细，参考《用QJM实现HDFS的高可用》

HDFS联邦

一个主NameNode里存放的元数据毕竟容量有限，在数据量大的时候，很可能无法满足需要。

HDFS联邦机制类似于HDFS的分片存储，把所有元数据分散在多个NameNode里，互相没有交集。

那么客户端怎么知道要访问的数据该连接哪一个NameNode呢？这涉及到在多个NameNode之上增加一个抽象层的问题，由抽象层来确定到底该访问哪一个NameNode。

大数据学习（03）——HDFS的高可用的更多相关文章

大数据学习笔记——HDFS理论知识之编辑日志与镜像文件
HDFS文件系统——编辑日志和镜像文件详细介绍我们知道,启动Hadoop之后,在主节点下会产生Namenode,即名称节点进程,该节点的目录下会保存一份元数据,用来记录文件的索引,而在从节点上即Da ...
入门大数据---基于Zookeeper搭建Kafka高可用集群
一.Zookeeper集群搭建为保证集群高可用,Zookeeper 集群的节点数最好是奇数,最少有三个节点,所以这里搭建一个三个节点的集群. 1.1 下载 & 解压下载对应版本 Zooke ...
入门大数据---基于Zookeeper搭建Spark高可用集群
一.集群规划这里搭建一个 3 节点的 Spark 集群,其中三台主机上均部署 Worker 服务.同时为了保证高可用,除了在 hadoop001 上部署主 Master 服务外,还在 hadoop0 ...
大数据学习之HDFS基本API操作（下）06
hdfs文件流操作方法一: package it.dawn.HDFSPra; import java.io.BufferedReader; import java.io.FileInputStream ...
大数据学习之HDFS基本API操作（上）06
package it.dawn.HDFSPra; import java.io.FileNotFoundException; import java.io.IOException; import ja ...
大数据学习之hdfs集群安装部署04
1-> 集群的准备工作 1)关闭防火墙(进行远程连接) systemctl stop firewalld systemctl -disable firewalld 2)永久修改设置主机名 vi ...
大数据学习笔记——HDFS写入过程源码分析(2)
HDFS写入过程注释解读 & 源码分析此篇博客承接上一篇未讲完的内容,将会着重分析一下在Namenode获取到元数据后,具体是如何向datanode节点写入真实的数据的 1. 框架图展示在 ...
大数据学习笔记——HDFS写入过程源码分析(1)
HDFS写入过程方法调用逻辑 & 源码注释解读前一篇介绍HDFS模块的博客中,我们重点从实践角度介绍了各种API如何使用以及IDEA的基本安装和配置步骤,而从这一篇开始,将会正式整理HDFS ...
大数据学习之HDFS基本命令操作05
1)hdfs的客户端 1.网页形式->测试用 http://192.168.40.11:50070/dfshealth.html#tab-overview 2.命令行形式->测试用 3.企 ...
大数据学习之HDFS的工作机制07
1:namenode+secondaryNameNode工作机制 2:datanode工作机制 3:HDFS中的通信(代理对象RPC) 下面用代码来实现基本的原理 1:服务端代码 package it ...

随机推荐

DG duplicate报错:RMAN-05001:auxiliary file name /u01/app/oracle/oradata/fratbs01.dbf conflicts with a file used by the target database
问题:rman duplicate时报错: RMAN-05001:auxiliary file name /u01/app/oracle/oradata/fratbs01.dbf conflicts ...
Centos7 unzip文件名中文乱码
Centos7 unzip文件名中文乱码前言今天在批量处理windos文件时为了方便操作,将windos下面的文件夹打成zip包上传至centos7中解压处理,发现解压后中文文件名变成了乱码,如下 ...
Ubuntu安装部署Kafka
Ubuntu安装部署Kafka 环境: Ubuntu 18.04.4 LTS ,JDK1.8,kafka_2.12-2.3.1 确保已经安装了JDK,JDK安装过程不再赘述.可参考文章xxxx 一.下 ...
Unity MVC思想
MVC框架概念MVC全名是Model View Controller,是模型(Model)-视图(View)-控制器(Controller)的缩写,一种软件设计典范,用一种业务逻辑.数据.界面显示分离 ...
Place the Robots 需要较强的建图能力
Place the Robots 思路:在任意一个点格子放机器人,那么它所在的行和列被控制了.我们对每一行或每一列连续的空地(草地忽视)称之为块,给每一行和每一列的块标号, 每一行的快与每一列的快相交 ...
Vue 两个字段联合校验典型例子--修改密码
1.前言本文是前文<Vue Element-ui表单校验规则,你掌握了哪些?>针对多字段联合校验的典型应用. 在修改密码时,一般需要确认两次密码一致,涉及2个属性字段.类似的涉及 ...
使用Hugo框架搭建博客的过程 - 功能拓展
前言本文介绍一些拓展功能,如文章页面功能增加二级菜单,相关文章推荐和赞赏.另外,使用脚本会大大简化写作后的上传流程. 文章页面功能这部分功能的拓展主要是用前端的JS和CSS,如果对前端不了解,可以 ...
B 站崩了，总结下「高可用」和「异地多活」
你好,我是悟空. 一.背景不用想象一种异常场景了,这就真实发生了:B 站晚上 11 点突然挂了,网站主页直接报 404. 手机 APP 端数据加载不出来. 23:30 分,B 站做了降级页面,将 4 ...
Docker基础：VMware虚拟机Centos7环境下docker安装及使用
1.docker简介 2.docker安装 3.卸载docker 4.阿里云镜像加速 5.docker的常用命令 5.1 帮助命令 5.2 镜像命令 5.3 容器命令 5.4 后台启动命令 5.5 查 ...
idea本地调式tomcat源码
前言上篇文章中一直没搞定的tomcat源码调试终于搞明白了,p神的代码审计星球里竟然有,真的好b(￣▽￣)d ,写一下过程,还有p神没提到的小坑准备阶段 1.去官网下东西:https://tomc ...