HDFS中的NameNode名节点—

HDFS缓冲区

Fsimage 文件映射，Edits文件操作记录。

与ES的缓冲区不同，ES是维护数据的变更，而HDFS缓冲区是用于名结点维护文件系统元数据（目录树）的机制。

在HDFS集群中，NameNode结点相较于DataNode数量较少，往往几个Namenode支撑着几百个DataNode的元数据和目录索引。当大量数据存入时，众多DataNode上同步进行的数据文件更新会在短时间内产生巨量的元数据（文件信息、块地址）。

想象一个这样的情况，1000台数据结点同时存入数据，但是只有一个名结点。1000GB的数据产生了10GB的元数据，数据节点很快处理完了1GB的平均数据量，但是名结点却要处理10GB的数据量，这时数据明明已经存入却不可用（因为不知道在哪）。

HDFS的FSimage缓冲机制，正是为了解决NameNode上元数据（目录）更新速度的问题，即NameNode直接在内存上更新元数据（内存更快），快速维护更新目录信息，并把数据的硬盘写入操作交由SecondaryNameNode完成（写入硬盘才能不丢失），这样便能保证目录的更新与数据存入相对同步完成。

具体过程：

HDFS启动时, 文件系统的目录树被加载到名节点内存，在Namenode上生成FSimages（元数据文件），此时的FSimages是真实的目录树。当发生数据操作的时候，数据请求经过处理后被分发到Datanode上进行存储，同时NameNode更新存储在内存中的FSimage，并且将数据操作相关信息保存到内存中的Edits文件。内存中的信息虽然快但是不稳定，如果宕机更新的目录树便会丢失，更改过的文件也就找不到了地址了，因此每隔一段时间需要元数据信息（目录）存储到磁盘。每过一段时间或者Fimage文件过大，NameNode会将二者发送给副名结点，副结点会完成二者的合并和检验，然后将新的FSimage推送到Namenode的硬盘上，同时更新Version文件，让NameNode使用新版的FSimage（旧版的也不会被删除）。只有当元数据被写入到硬盘后，存储的数据才是真正安全的存入了。

HDFS中的NameNode名节点——FSimage的更多相关文章

018 HDFS中，namenode与datanode的交互
1.解释 2.启动过程 namenode需要等待给他汇报块的情况,然后namenode会给datanode一个反馈. namenode在启动的时候有一个等待的过程. 3.如果有块损坏等待报告中,na ...
hadoop的hdfs中的namenode和datanode知识总结
一,NameNode: 1, Namenode是中心服务器,单一节点(简化系统的设计和实现),负责管理文件系统的名称空间(namespace)以及客户端对文件的访问. 2, 文件操作,Namenod ...
HDFS中NameNode管理元数据机制
NameNode职责响应客户端请求维护目录树管理元数据(查询,修改) HDFS元数据存储内存中有一份完整的元数据(特定数据结构) 磁盘有一个“准完整”的元数据的镜像文件当客户端对HDFS中的 ...
【Hadoop学习】HDFS中的集中化缓存管理
Hadoop版本:2.6.0 本文系从官方文档翻译而来,转载请尊重译者的工作,注明以下链接: http://www.cnblogs.com/zhangningbo/p/4146398.html 概述 ...
Sqoop1.99.7将MySQL数据导入到HDFS中
准备本示例将实现从MySQL数据库中将数据导入到HDFS中参考文档: http://sqoop.apache.org/docs/1.99.7/user/Sqoop5MinutesDemo.html ...
从 secondarynamenode 中恢复 namenode
1.修改 conf/core-site.xml,增加 Xml代码 <property> <name>fs.checkpoint.period</name> < ...
关于oracle的缓冲区机制与HDFS中的edit logs的某些关联性的思考
可能大家会问,oracle和HDFS属于不同场景的存储系统,它们之间为什么会有联系呢?确实,从技术本身来看,他们确实无关联,但利用“整体学习”的思想,跳出技术本身,可以发现Oracle的缓冲区和HDF ...
HDFS中的读写数据流
1.文件的读取在客户端执行读取操作时,客户端和HDFS交互过程以及NameNode和各DataNode之间的数据流是怎样的?下面将围绕图1进行具体讲解. 图 1 客户端从HDFS中读取数据 1)客户 ...
Hadoop HDFS 中的一些常用命令
转载自:hadoop HDFS常用文件操作命令命令基本格式: hadoop fs -cmd < args > 1.ls hadoop fs -ls / 列出hdfs文件系统根目录下的目录 ...

随机推荐

oracle根据日期计算星期几
工作中用到的,在存储过程中的语句,简单记下: /** 判断输入日期是星期几 */ select decode(to_char(to_date(iv_date,'yyyy-mm-dd'), 'day') ...
jvm系列二内存结构
二.内存结构整体架构 1.程序计数器作用用于保存JVM中下一条所要执行的指令的地址特点线程私有 CPU会为每个线程分配时间片,当当前线程的时间片使用完以后,CPU就会去执行另一个线程中的代码 ...
使用 noexcept 我们需要知道什么？
noexcept 关键字 noexcept 是什么? noexcept 是自 C++11 引入的新特性,指定函数是否可能会引发异常,以下是 noexcept 的标准语法: noexcept-expre ...
CF-125E MST Company (单度限制最小生成树）
参考红宝书题目链接对除 1 号点顶点外的点集,求一次最小生成森林,对于最小生成森林的联通分量,选择最短的一条边与 1 号点相连.设此时 1 号点的度为 $k_0$,如果 \(k_0\lt L\ ...
2015-2016 ACM-ICPC, NEERC, Northern Subregional Contest (9/12)
$$2015-2016\ ACM-ICPC,\ NEERC,\ Northern\ Subregional\ Contest$$ $A.Alex\ Origami\ Squares$ 签到 //# ...
【uva 1471】Defense Lines（算法效率--使用数据结构+部分枚举+类贪心）
P.S.我完全一个字一个字敲出来的血泪史啊~~所以,没有附代码,也是可以理解的啦.OvO 题意:给一个长度为N(N≤200000)的序列,要删除一个连续子序列,使得剩下的序列中有一个长度最大的连续递增 ...
hdu5233 Gunner II
Problem Description Long long ago, there was a gunner whose name is Jack. He likes to go hunting ver ...
Codeforces Round #550 (Div. 3) E. Median String (思维,模拟)
题意:给你两个字符串$s$和$t$,保证$t$的字典序大于$s$,求他们字典序中间的字符串. 题解:我们假设题目给的不是字符串,而是两个10禁止的正整数,那么输出他们之间的数只要把他两 ...
Codeforces Round #649 (Div. 2) A. XXXXX (贪心)
题意:有一个长度为$n$的数组,找一段最长子数组,使得其元素和为$x$,如果存在,输出子数组的长度,否则输出$-1$. 题解:这题我们要从元素和$sum$来考虑,首先,如果原数组的所有 ...
【译】Async/Await（五）—— Executors and Wakers
原文标题:Async/Await 原文链接:https://os.phil-opp.com/async-await/#multitasking 公众号: Rust 碎碎念翻译 by: Praying ...

HDFS中的NameNode名节点——FSimage

HDFS缓冲区

HDFS中的NameNode名节点——FSimage的更多相关文章

随机推荐

热门专题