hadoop管理
hadoop管理工具:
一,dfsadmin工具
dfsadmin 工具用途比较广,既可以查找HDFS状态信息,又可以在HDFS上执行管理操作,以hdfs dfsadmin形式调用,且需要超级用户权限
二, 文件系统检查工具fsck
fsck检查HDFS中问文件的健康状况,该工具会查找那些在所有datanode中缺失的块以及过多或过少的复本块
%hdfs fsck /
fsck 工具从给定的路径开始循环遍历文件系统的命名空间,并检查他所找到的文件
注意:fsck是从namenode获取信息,并不与datanode进行交互操作,因此并不真正获得块数据
查找文件的数据块
%hdfs fsck /user/tom/part-00007 -files -blocks -racks
参数:-files 显示第一行信息,包括文件名称,大小,块数量和健康状况
-blocks 描述文件中各个块的信息,每个块一行
-racks 显示各个块的机架位置和datanode位置
三,datanode块扫描器
各个datanode 运行一个块扫描器,定期检查本节点上的所有块,从而在客户端读到坏块之前及时修复和检测坏块,扫描器使用节流机制,即扫描器工作时占用一部分磁盘带宽
设置 dfs.datanode.scan.period.hours 设置扫描周期
四,均衡器
均衡器是hadoop的一个守护进程,将块从忙碌的datanode 移至空闲的datanode,重新分配块
启动均衡器
%start-balancer.sh
hdfs-site.xml中设置dfs.datanode.balance.bandwidthPerSec 设置均衡器可以使用的带宽
hadoop监控:
hadoop所有的守护进程都会产生日志
一,设置日志级别:
通过 守护进程网页/logLevel目录下来改变log4j日志名称级别
为所有以给定前缀开始的类包启用日志: 1)http://服务/logLevel 2)命令:%hadoop daemonlog -setlevel 守护进程服务:端口 设置选项 日志级别
获取栈追踪:
hadoop守护进程提供一个网页 网页界面/stacks目录 对正在守护进程的JVM中运行着的线程执行线程转存储(thread dump)
委任和解除节点:
向集群添加新节点步骤:
1)将新节点的网络地址添加到include文件
2)运行以下指令,将审核过的一系列datanode集合更新至namenode信息中
%hdfs dfsadmin -refreshNodes
3) 运行以下指令,将审核过的一系列节点管理器更新至资源管理器
%yarn rmadmin -refreshNodes
4) 以新节点更新slaves文件
5)启动新的datanode 和 节点管理器
6)检查新的datanode 和 节点管理器是否都出现在网页界面中
解除旧节点步骤如下:
1)将待解除节点的网络地址添加到exclude文件中,不更新include文件
2)执行以下指令,使用一组新的datanode来更新namenode设置
%hdfs dfsadmin -refreshNodes
3)更新资源管理器设置
%yarn rmadmin -refreshNodes
4)转到网页界面,查看待解除datanode状态是否变为“正在解除”
5)datanode状态变为“解除完毕”,表明所有块复制完成,关闭已经解除节点
6)从include文件中移除这些节点,运行以下命令
%hdfs dfsadmin -refreshNodes
%yarn rmadmin -refreshNodes
7)从slave文件中移除节点
集群升级步骤:
1)执行升级任务前,确保前一升级已经定妥
2)关闭yarn ,mapreduce 守护进程
3)关闭HDFS,备份namenode目录
4)在集群和客户端安装新版本hadoop
5)使用-upgrade期待HDFS
%$NEW_hadoop_home/bin/start-dfs.sh -upgrade
6)等待升级完成
%NEW_hadoop_home/bin/hdfs dfsadmin -upgradeProgress status
7)检验HDFS是否正常运行
8)启动yarn mapreduce守护进程
9)回滚或定妥升级任务
回滚:
%$NEW_hadoop_home/bin/stop-dfs.sh
%$OLD_hadoop_home/bin/start-dfs.sh -rollback
在执行新的升级任务之前,必须执行这一步:
%$NEW_hadoop_home/bin/hdfs dfsadmin -finalizeUpgrade
%$NEW_hadoop_home/bin/hdfs dfsadmin -upgradeProgress status
hadoop管理Web界面:
YARN的Web客户端端口号是8088,通过http://192.168.108.99:8088/可以查看
hadoop管理的更多相关文章
- 查看hadoop管理页面,修改本地hosts,Browse the filesystem
问题: hadoop管理界面,ip:50070,中点击Browse the filesystem会出现网页无法访问,看地址栏,是集群中的主机名::50075/browseDirectory.jsp?n ...
- hadoop 管理命令dfsadmin
hadoop 管理命令dfsadmin dfsadmin 命令用于管理HDFS集群,这些命令常用于管理员. 1. (Safemode)安全模式 动作 命令 把集群切换到安全模式 bin/hdfs df ...
- hadoop基础----hadoop实战(七)-----hadoop管理工具---使用Cloudera Manager安装Hadoop---Cloudera Manager和CDH5.8离线安装
hadoop基础----hadoop实战(六)-----hadoop管理工具---Cloudera Manager---CDH介绍 简介 我们在上篇文章中已经了解了CDH,为了后续的学习,我们本章就来 ...
- Hadoop 管理工具HUE配置-集成Unix用户和用户组
HUE安装完成之后,第一次登录的用户就是HUE的超级用户,可以管理用户,等等.但是在用的过程发现一个问题这个用户不能管理HDFS中由supergroup创建的数据. 虽然在HUE中创建的用户可以管理自 ...
- Hadoop 管理工具HUE配置-hdfs_clusters配置
在HUE的hdfs_clusters中目前主要是配置hdfs相关的,配置好了之后便可以在hue中愉快的管理数据了,不过目前的配置还是比较...简单的.. 里面的配置主要是参考了hue官方文档,还 ...
- Hadoop 管理工具HUE配置-filebrowser配置
Hue提供了图形化截面管理HDFS数据,可谓之非常方便,但是在配置上,还是有点麻烦的. 1 /home/hadoop/software/cloud/hue/desktop/conf/pseudo-di ...
- hadoop基础----hadoop实战(九)-----hadoop管理工具---CDH的错误排查(持续更新)
在CDH安装完成后或者CDH使用过程中经常会有错误或者警报,需要我们去解决,积累如下: 解决红色警报 时钟偏差 这是因为我们的NTP服务不起作用导致的,几台机子之间有几秒钟的时间偏差. 这种情况下一是 ...
- hadoop管理命令
-help 功能:输出这个命令参数手册 -ls 功能:显示目录信息 示例: hadoop fs -ls hdfs://hadoop-server01:9000/ 备注:这些参数中,所有的hdfs ...
- Hadoop 管理工具HUE配置-HBase配置
1 前言 首先要陪只好HBase,可以参见http://www.cnblogs.com/liuchangchun/p/4096891.html,完全分布式类似 2 HBase配置 2.1 HUE 配置 ...
随机推荐
- 一道与时间差有关的SQL面试题
题目: 一组通话记录(总共500万条):ID 主叫号码 被叫号码 通话起始时间 通话结束时间 通话时长1 98290000 0215466546656 2007-02-01 09:49:53.000 ...
- javascript中的数字玩法,颠覆你的眼睛
1.JavaScript中的数字中有一些很奇葩的现象. 在Chrome控制台中可以自己做一下实验: 1 === 1.0 ; //true 习惯了强类型语言,如java,c,OC看到这个结论还是有点小迷 ...
- rsync定时同步文件
rsync服务器 ip:192.168.1.198 操作系统:centos7.2 rsync客户端 ip:192.168.1.16 操作系统:centos7.2 服务器配置 1.yum -y inst ...
- C# Winform同一子窗体只允许打开一次
在winform中一个窗口可以一直打开,是不合理的,解决方法: http://blog.csdn.net/kangkang621/article/details/49664295
- Spring Boot引起的“堆外内存泄漏”排查及经验总结
小结: 检索词:C++内存分配器.jvm内存模型.gdb.内存泄露 https://tech.meituan.com/2019/01/03/spring-boot-native-memory-leak ...
- 下载隐含的qq音乐
最终按Ctrl+s .或者点击“下载”即可.格式可能为m4a
- delphi加载ADOQUERY
CxgridDBTableView3.ClearItems;//这里是cxgrid的表层,先清除之前的列再创建 for I:=0 to adoquery1.FieldCount-1 do begi ...
- JMeter之http接口测试
能做哪些类型性能测试 接口 文件传输(ftp) 数据库 支持自定义java组件开发 安装 http://jmeter.apache.org/ 进入上面的链接 选择合适版本下载 启动 使用 Jmeter ...
- 洛谷P3234 抄卡组 [HNOI2014] 字符串hash
正解:字符串hash 解题报告: 传送门! 字符串hash是字符串匹配中很常见的一个方法,原理也很好懂,这里就不做太多阐述辣有时间放到hash笔记里面去QAQ 题意不说了挺好理解的,自带一句话概括好评 ...
- es中filter和query的对比
1.filter与query示例PUT /company/employee/2{ "address": { "country": "china&quo ...