重启hdfs集群的时候，报大量的gc问题。

问题现象：

2019-03-11 12:30:52,174 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7653ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=7692ms

2019-03-11 12:31:00,573 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7899ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=7951ms

2019-03-11 12:31:08,952 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7878ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=7937ms

2019-03-11 12:31:17,405 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7951ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=8037ms

2019-03-11 12:31:26,611 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 8705ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=8835ms

2019-03-11 12:31:35,009 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7897ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=8083ms

2019-03-11 12:31:43,806 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 8296ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=8416ms

2019-03-11 12:31:52,317 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 8010ms

GC pool 'ConcurrentMarkSweep' had collection(s): count=1 time=8163ms

2019-03-11 12:32:00,680 INFO org.apache.hadoop.util.JvmPauseMonitor: Detected pause in JVM or host machine (eg GC): pause of approximately 7862ms

gc一段时间后出现：

2019-03-11 12:27:15,820 ERROR org.apache.hadoop.hdfs.server.namenode.NameNode: Failed to start namenode.

java.lang.OutOfMemoryError: Java heap space

        at java.lang.StringCoding$StringEncoder.encode(StringCoding.java:300)

        at java.lang.StringCoding.encode(StringCoding.java:344)

        at java.lang.String.getBytes(String.java:918)

        at java.io.UnixFileSystem.getBooleanAttributes0(Native Method)

        at java.io.UnixFileSystem.getBooleanAttributes(UnixFileSystem.java:242)

        at java.io.File.exists(File.java:819)

        at sun.misc.URLClassPath$FileLoader.getResource(URLClassPath.java:1282)

        at sun.misc.URLClassPath.getResource(URLClassPath.java:239)

        at java.net.URLClassLoader$1.run(URLClassLoader.java:365)

        at java.net.URLClassLoader$1.run(URLClassLoader.java:362)

        at java.security.AccessController.doPrivileged(Native Method)

        at java.net.URLClassLoader.findClass(URLClassLoader.java:361)

        at java.lang.ClassLoader.loadClass(ClassLoader.java:424)

        at sun.misc.Launcher$AppClassLoader.loadClass(Launcher.java:349)

        at java.lang.ClassLoader.loadClass(ClassLoader.java:357)

        at org.apache.hadoop.hdfs.server.namenode.JournalSet.close(JournalSet.java:244)

        at org.apache.hadoop.hdfs.server.namenode.FSEditLog.close(FSEditLog.java:400)

        at org.apache.hadoop.hdfs.server.namenode.FSEditLogAsync.close(FSEditLogAsync.java:112)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.close(FSImage.java:1408)

        at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.loadFSImage(FSNamesystem.java:1079)

        at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.loadFromDisk(FSNamesystem.java:681)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.loadNamesystem(NameNode.java:666)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.initialize(NameNode.java:728)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.<init>(NameNode.java:953)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.<init>(NameNode.java:932)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.createNameNode(NameNode.java:1673)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.main(NameNode.java:1741)

2019-03-11 12:27:15,827 INFO org.apache.hadoop.util.ExitUtil: Exiting with status 1: java.lang.OutOfMemoryError: Java heap space

2019-03-11 12:27:15,830 INFO org.apache.hadoop.hdfs.server.namenode.NameNode: SHUTDOWN_MSG:

或者出现下面的错误：

2019-03-11 11:09:16,124 ERROR org.apache.hadoop.hdfs.server.namenode.NameNode: Failed to start namenode.

java.lang.OutOfMemoryError: GC overhead limit exceeded

        at com.google.protobuf.CodedInputStream.<init>(CodedInputStream.java:573)

        at com.google.protobuf.CodedInputStream.newInstance(CodedInputStream.java:55)

        at com.google.protobuf.AbstractParser.parsePartialFrom(AbstractParser.java:199)

        at com.google.protobuf.AbstractParser.parsePartialDelimitedFrom(AbstractParser.java:241)

        at com.google.protobuf.AbstractParser.parseDelimitedFrom(AbstractParser.java:253)

        at com.google.protobuf.AbstractParser.parseDelimitedFrom(AbstractParser.java:259)

        at com.google.protobuf.AbstractParser.parseDelimitedFrom(AbstractParser.java:49)

        at org.apache.hadoop.hdfs.server.namenode.FsImageProto$INodeSection$INode.parseDelimitedFrom(FsImageProto.java:10867)

        at org.apache.hadoop.hdfs.server.namenode.FSImageFormatPBINode$Loader.loadINodeSection(FSImageFormatPBINode.java:233)

        at org.apache.hadoop.hdfs.server.namenode.FSImageFormatProtobuf$Loader.loadInternal(FSImageFormatProtobuf.java:250)

        at org.apache.hadoop.hdfs.server.namenode.FSImageFormatProtobuf$Loader.load(FSImageFormatProtobuf.java:176)

        at org.apache.hadoop.hdfs.server.namenode.FSImageFormat$LoaderDelegator.load(FSImageFormat.java:226)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.loadFSImage(FSImage.java:937)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.loadFSImage(FSImage.java:921)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.loadFSImageFile(FSImage.java:794)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.loadFSImage(FSImage.java:724)

        at org.apache.hadoop.hdfs.server.namenode.FSImage.recoverTransitionRead(FSImage.java:322)

        at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.loadFSImage(FSNamesystem.java:1052)

        at org.apache.hadoop.hdfs.server.namenode.FSNamesystem.loadFromDisk(FSNamesystem.java:681)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.loadNamesystem(NameNode.java:666)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.initialize(NameNode.java:728)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.<init>(NameNode.java:953)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.<init>(NameNode.java:932)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.createNameNode(NameNode.java:1673)

        at org.apache.hadoop.hdfs.server.namenode.NameNode.main(NameNode.java:1741)

2019-03-11 11:09:16,127 INFO org.apache.hadoop.util.ExitUtil: Exiting with status 1: java.lang.OutOfMemoryError: GC overhead limit exceeded

解决：

打开hadoop-env.sh文件，找到HADOOP_HEAPSIZE= 和HADOOP_NAMENODE_INIT_HEAPSIZE= 调整这两个参数，具体调整多少，视情况而定，默认是1000m，也就是一个g，我这里调整如下：

export HADOOP_HEAPSIZE=32000

export HADOOP_NAMENODE_INIT_HEAPSIZE=16000                  这两个参数去掉前面的#号，两台namenode节点都要调整

接着重新启动hdfs，如果还不行，打开hadoop-env.sh文件，找到HADOOP_NAMENODE_OPTS

export HADOOP_NAMENODE_OPTS="-Dhadoop.security.logger=${HADOOP_SECURITY_LOGGER:-INFO,RFAS} -Dhdfs.audit.logger=${HDFS_AUDIT_LOGGER:-INFO,NullAppender}  $HADOOP_NAMENODE_OPTS"    ----这是系统默认值

调整如下：

export HADOOP_NAMENODE_OPTS="-Dhadoop.security.logger=${HADOOP_SECURITY_LOGGER:-INFO,RFAS} -Dhdfs.audit.logger=${HDFS_AUDIT_LOGGER:-INFO,NullAppender}  -Xms6000m -Xmx6000m -XX:+UseCompressedOops -XX:+UseParNewGC -XX:+UseConcMarkSweepGC -XX:+CMSClassUnloadingEnabled -XX:+UseCMSCompactAtFullCollection -XX:CMSFullGCsBeforeCompaction=0 -XX:+CMSParallelRemarkEnabled -XX:+DisableExplicitGC -XX:+UseCMSInitiatingOccupancyOnly -XX:CMSInitiatingOccupancyFraction=75 -XX:SoftRefLRUPolicyMSPerMB=0 $HADOOP_NAMENODE_OPTS"

接着重新启动hdfs，如果还是报上面的错误，那就继续调大上面

HADOOP_HEAPSIZE和

HADOOP_NAMENODE_INIT_HEAPSIZE  的值

重启hdfs集群的时候，报大量的gc问题。的更多相关文章

vivo 万台规模 HDFS 集群升级 HDFS 3.x 实践
vivo 互联网大数据团队-Lv Jia Hadoop 3.x的第一个稳定版本在2017年底就已经发布了,有很多重大的改进. 在HDFS方面,支持了Erasure Coding.More than 2 ...
大数据学习之hdfs集群安装部署04
1-> 集群的准备工作 1)关闭防火墙(进行远程连接) systemctl stop firewalld systemctl -disable firewalld 2)永久修改设置主机名 vi ...
HDFS集群常见报错汇总
HDFS集群常见报错汇总作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.DataXceiver error processing WRITE_BLOCK operation 报 ...
大数据学习笔记03-HDFS-HDFS组件介绍及Java访问HDFS集群
HDFS组件概述 NameNode 存储数据节点信息及元文件,即:分成了多少数据块,每一个数据块存储在哪一个DataNode中,每一个数据块备份到哪些DataNode中这个集群有哪些DataNode ...
马士兵hadoop第二课：hdfs集群集中管理和hadoop文件操作
马士兵hadoop第一课:虚拟机搭建和安装hadoop及启动马士兵hadoop第二课:hdfs集群集中管理和hadoop文件操作马士兵hadoop第三课:java开发hdfs 马士兵hadoop第 ...
马士兵hadoop第二课：hdfs集群集中管理和hadoop文件操作（转）
马士兵hadoop第一课:虚拟机搭建和安装hadoop及启动马士兵hadoop第二课:hdfs集群集中管理和hadoop文件操作马士兵hadoop第三课:java开发hdfs 马士兵hadoop第 ...
大数据（2）---HDFS集群搭建
一.准备工作 1.准备几台机器,我这里使用VMware准备了四台机器,一个name node,三个data node. VMware安装虚拟机:https://www.cnblogs.com/niju ...
HDFS集群balance（2）-- 架构概览
转载请注明博客地址:http://blog.csdn.net/suileisl HDFS集群balance,对应版本balance design 6 如需word版本,请QQ522173163联系索要 ...
HDFS集群balance（3）-- 架构细节
转载请注明博客地址:http://blog.csdn.net/suileisl HDFS集群balance,对应版本balance design 6 如需word版本,请QQ522173163联系索要 ...

随机推荐

Java 面向对象_接口
接口定义接口就是多个类的公共规范接口是一种引用数据类型, 最重要的内容是其中的抽象方法定义格式: public interface MyInterfaceAbstract { // 这是一个抽象 ...
php批量检测并去除BOM头的代码
开发中会遇到BOM头, 导致程序无法执行. 浏览器返回接口如下图: 去除BOM头解决方法:<?phpini_set('memory_limit','1024M'); function check ...
数据结构之链表(LinkedList)(一)
链表(Linked List)介绍链表是有序的列表,但是它在内存中是存储如下 1)链表是以节点方式存储的,是链式存储 2)每个节点包含data域(value),next域,指向下一个节点 3)各个节 ...
galera集群
一.环境准备 1.各主机配置静态域名解析: cat /etc/hosts 127.0.0.1 localhost localhost.localdomain localhost4 localhos ...
【转载】C#使用as关键字将对象转换为指定类型
在C#的编程开发过程中,很多时候涉及到数据类型的转换,可使用强制转换的方式,不过强制转换数据类型有时候会抛出程序异常错误,可以使用as关键字来进行类型的转换,如果转换成功将返回转换后的对象,如果转换不 ...
简单记录一次注入到shell
0x00 前言帮朋友之前拿的一个站,有点久了没有完整截图,简单记录一下. 0x01 基础信息操作系统:win 集成环境:phpstudy 端口开放:82,3306,3389 有phpmyadmin ...
七年总结常用 Git 命令清单
我每天使用 Git ,但是很多命令记不住. 一般来说,日常使用只要记住下图6个命令,就可以了.但是熟练使用,恐怕要记住60-100个命令. 下面是我整理的常用 Git 命令清单.几个专用名词的译名如下 ...
DNS服务——搭建企业内网DNS服务器的作用
前言 DNS服务——服务端和客户端配置介绍了如何在DNS安装DNS服务,更改一下配置文件就可以依据根提示解析全球域名.既然使用互联网上的DNS服务器就可以解析全球域名,为何还要自掏腰包搭建DN ...
每日一题-——LeetCode(121)买卖股票的最佳时机
题目描述: 给定一个数组,它的第 i 个元素是一支给定股票第 i 天的价格.如果你最多只允许完成一笔交易(即买入和卖出一支股票),设计一个算法来计算你所能获取的最大利润.注意你不能在买入股票前卖出股票 ...
php多版本配置
需求分析: 需要在一台装有php5.4的测试服务器跑的上php7.2.x的项目安装phpenv(php版本控制) $ sudo yum install git $ mkdir -p repos/gi ...

重启hdfs集群的时候，报大量的gc问题。

重启hdfs集群的时候，报大量的gc问题。的更多相关文章

随机推荐

热门专题