NameNode&Secondary NameNode 工作机制

NameNode:

	1.启动时，加载编辑日志和镜像文件到内存

	2.当客户端对元数据进行增删改，请求NameNode

	3.NameNode记录操作日志，更新滚动日志

	4.日志记录完成，在NameNode内存中对元数据进行操作

	edits.001 操作日志

	edits.002

	edits.inprogress 正在进行的操作日志

	fsimage	镜像文件

SecondaryNameNode:（其主要作用就是：合并edit和fsimage）

	0.检查点（checkpoint）触发。条件是：

		a.定时时间到（默认一个小时）

		b.操作日志中的数据满了（100w次操作）

	1.请求NameNode是否需要CheckPoint，直接带回 NameNode是否检查结果

	2.执行CheckPoint请求

	3.滚动正在写的操作日志，生成最新的一个操作日志

	4.将操作日志和之前旧的镜像fsimage文件拷贝到SecondaryNameNode

	5.在SecondaryNameNode内存中合并日志文件和fsimage文件

	6.生成新的fsimage.chkpoint

	7.将fsimage.chkpoint拷贝到NameNode中

	8.重命名fsimage.chkpoint为fsimage

日志文件

目录结构：

$HADOOP_HOME/data/tmp/dfs/name/current

$HADOOP_DATA_HOME/tmp/dfs/name/current

edits_0000000000000000000

fsimage_0000000000000000000.md5

seen_txid

VERSION

1.fsimage:

	HDFS 文件系统元数据的一个永久性的检查点，其中包含 HDFS文件系统的所有目录和文件 idnode 的序列化信息

2.edits:

	存放 HDFS 文件系统的所有更新操作的路径，文件系统客户端执行的所有写操作首先会被记录到 edits 文件中。

3.seen_txid:

	文件保存的是一个数字，就是最后一个 edits_的数字

	每次 Namenode 启动的时候都会将 fsimage 文件读入内存，

	并从 00001 开始到 seen_txid 中记录的数字依次执行每个 edits 里面的更新操作，

	保证内存中的元数据信息是最新的、同步的，可以看成 Namenode 启动的时候就将 fsimage 和 edits 文件进行了合并。

查看fsimage文件和edits文件

oiv 查看 fsimage 文件

	hdfs oiv -p 文件类型 -i 镜像文件 -o 转换后文件输出路径

	hdfs oiv -p XML -i fsimage_0000000000000000025 -o  /opt/module/hadoop-2.7.2/fsimage.xml

oev 查看 edits 文件

	hdfs oev -p 文件类型 -i 编辑日志 -o 转换后文件输出路径

	hdfs  oev  -p  XML  -i edits_0000000000000000012-0000000000000000013 -o /opt/module/hadoop-2.7.2/edits.xml

chkpoint 检查时间参数设置

hdfs-default.xml

<!-- 默认：SecondaryNameNode 每隔一小时执行一次 -->

	<property>

		<name>dfs.namenode.checkpoint.period</name>

		<value>3600</value>

	</property>

<!-- 一分钟检查一次操作次数，当操作次数达到 1 百万时，SecondaryNameNode 执行一次。 -->

	<property>

		<name>dfs.namenode.checkpoint.txns</name>

		<value>1000000</value>

		<description>操作动作次数</description>

	</property>

	<property>

		<name>dfs.namenode.checkpoint.check.period</name>

		<value>60</value>

		<description> 1 分钟检查一次操作次数</description>

	</property>

NameNode多目录配置

NameNode 的本地目录可以配置成多个，且每个目录存放内容相同，增加了可靠性。

配置步骤：

（1）在 hdfs-site.xml 文件中增加如下内容

	<property>

		<name>dfs.namenode.name.dir</name>

		<value>file:///${hadoop.tmp.dir}/dfs/name1,file:///${hadoop.tmp.dir}/dfs/name2</value>

	</property>

（2）停止集群，删除 data 和 logs 中所有数据

	$ rm -rf data/ logs/

（3）格式化集群并启动。

	$ bin/hdfs namenode –format

	$ sbin/start-dfs.sh

NameNode&Secondary NameNode 工作机制的更多相关文章

NameNode && Secondary NameNode工作机制
NameNode && Secondary NameNode工作机制 1)工作流程 2) fsimage和edits NameNode是HDFS的大脑,它维护着整个文件系统的目录树, ...
hadoop及NameNode和SecondaryNameNode工作机制
hadoop及NameNode和SecondaryNameNode工作机制 1.hadoop组成 Common MapReduce Yarn HDFS (1)HDFS namenode:存放目录,最重 ...
Hadoop（五）—— HDFS NameNode、DataNode工作机制
一.NN与2NN工作机制 NameNode(NN) 1.当HDFS启动时,会加载日志(edits)和镜像文件(fsImage)到内存中. 2-4.当元数据的增删改查请求进来时,NameNode会先将操 ...
NameNode和SecondaryNameNode的工作机制
NameNode&Secondary NameNode 工作机制 NameNode: 1.启动时,加载编辑日志和镜像文件到内存 2.当客户端对元数据进行增删改,请求NameNode 3.Nam ...
HDFS中NameNode工作机制
引言 NameNode: 存储元数据管理整个HDFS集群 DataNode: 存储数据的block SecondaryNameNode: 辅助HDFS完成一些事情 NameNode和Secondar ...
NameNode和SecondaryNameNode工作原理剖析
NameNode和SecondaryNameNode工作原理剖析作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.NameNode中的元数据是存储在那里的? 1>.首先,我 ...
Secondary Namenode - What it really do?
原文链接:http://blog.madhukaraphatak.com/secondary-namenode---what-it-really-do/ Secondary Namenode is o ...
HDFS中NameNode和Secondary NameNode工作机制
NameNode工作机制 0)启动概述 Namenode启动时,首先将映像文件(fsimage)载入内存,并执行编辑日志(edits)中的各项操作.一旦在内存中成功建立文件系统元数据的映像,则创建一个 ...
Hadoop的namenode的管理机制，工作机制和datanode的工作原理
HDFS前言: 1) 设计思想分而治之:将大文件.大批量文件,分布式存放在大量服务器上,以便于采取分而治之的方式对海量数据进行运算分析: 2)在大数据系统中作用: 为各类分布式运算框架(如:mapr ...

随机推荐

adb bat
@REM 生成随机数@echo off@REM 设置延迟变量setlocal enabledelayedexpansionset min=9set max=21set /a mod=!max!-!mi ...
android体温登记APP开发过程+问题汇总+源码
源码上传至https://github.com/durtime/myproject下的temperature 实际效果: 开发过程 1.首先进行布局文件的编写,布局前台页面 2.布置两个按钮,一个 ...
Java基础00-网络编程29
1. 网络编程入门 1.1 网络编程概述 1.2 网络编程三要素 1.3 IP地址在命令提示符中使用 1.4 InetAddress的使用代码示例: public class InetAddres ...
java使用IO读写文件
https://www.cnblogs.com/qiaoyeye/p/5383723.html java读写文件的IO流分两大类,字节流和字符流,基类分别是字符:Reader和Writer:字节:In ...
[刘阳Java]_为什么要前后端分离
前后端分离已成为互联网项目开发的业界标准使用方式,通过nginx+tomcat的方式(也可以中间加一个nodejs)有效的进行解耦,并且前后端分离会为以后的大型分布式架构.弹性计算架构.微服务架构.多 ...
JDK安装与环境搭建.
卸载JDK 1.删除Java安装目录 2.删除Java Home 3.删除path下Java的目录 4.打开cmd命令输入java-version 出现''不是内部或外部命令,也不是可运行的程序或批 ...
Linux从入门到进阶全集——【第十四集：Shell编程-export命令】
参考: https://www.cnblogs.com/guojun-junguo/p/9855356.html 功能说明:设置或显示环境变量. 语法:export [-fnp][变量名称]=[变量 ...
微信小程序云开发-数据条件查询
一.使用where条件查询在.get()语句之前增加.where语句实现条件查询. 二.通过doc查询单条数据 1.使用doc来查询数据库中的单条数据 2.定义一个空对象,用来展示插叙到的单条数据 ...
P1447能量采集
P1447能量采集定义:(i,j)表示处于(i,j)的植物的贡献我们发现,点(i,j)与(0,0)的连线所过整点的数目为\(\gcd(i,j)\) 发现要是想记录每个点的答案并不好算.那么怎么好算 ...
GeoServer Rest服务启动匿名认证的配置方法
GeoServer Rest服务数据默认需要进行用户名.密码的认证,如不需进行该认证,则启动匿名认证即可,配置方式如下(针对war包发布的GeoServer应用): 在GeoServer war包的解 ...

NameNode&Secondary NameNode 工作机制

NameNode&Secondary NameNode 工作机制

日志文件

目录结构：

查看fsimage文件和edits文件

chkpoint 检查 时间 参数 设置

NameNode多目录配置

NameNode&Secondary NameNode 工作机制的更多相关文章

随机推荐

热门专题

chkpoint 检查时间参数设置