即将上线的flume服务器面临的一系列填坑笔记

　　　　　　　　　　　　　　　　　　即将上线的flume服务器面临的一系列填坑笔记

　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　　作者：尹正杰

一.flume缺少依赖包导致启动失败！

报错信息如下：

2018-10-17 11:07:43,369 (conf-file-poller-0) [ERROR - org.apache.flume.node.PollingPropertiesFileConfigurationProvider$FileWatcherRunnable.run(PollingPropertiesFileConfigurationProvider.java:146)] Failed to start agent because dependencies were not found in classpath. Error follows.

　　上面的报错信息很明显的告诉了我们，缺少依赖包。没有找到依赖环境！我对比了线上的flume的lib目录下和我新集群的lib目录，发现是有点不一样！下图就是我线上的环境：

　　下图就是我新集群的环境：

　　此时相信大家看到这种情况，已经迫不及待的想把线上的jar包都拷贝过来，观察问题是否解决，没错，我也是这么想的，于是我将线上的jar包拷贝到了我的集群。如下图：

　　拷贝完成后，观察我的新集群的jar包和线上jar包环境是一致的！如下图：

　　我新集群的环境和线上的保持一致后，重新执行上述的错误就不在出现啦！

二.内存溢出，导致flume运行崩溃

解决了上面关于依赖包的问题，发现新错又出现了，报错OOM，报错信息如下：

Exception in thread "PollableSourceRunner-KafkaSource-kafkaSource" java.lang.OutOfMemoryError: GC overhead limit exceeded
at java.util.ArrayList.iterator(ArrayList.java:834)

Exception: java.lang.OutOfMemoryError thrown from the UncaughtExceptionHandler in thread "PollableSourceRunner-KafkaSource-kafkaSource"
Exception in thread "SinkRunner-PollingRunner-DefaultSinkProcessor" java.lang.OutOfMemoryError: GC overhead limit exceeded

Exception: java.lang.OutOfMemoryError thrown from the UncaughtExceptionHandler in thread "SinkRunner-PollingRunner-DefaultSinkProcessor"

　　相必须看到上述的报错的小伙伴应该都跟我一样，第一反应就是调大内存，在将堆内存调大之前，我们先看一下flume默认给我分配堆堆内存是多大，如下图：（我们看到flume默认指定堆堆大堆内存为20M，它崩溃了是理所当然的，毕竟我们公司的数据量也不小！）

　　你是不是很好奇，这个20M大小在哪里设置的呢？其实就是在flume-ng这个脚本里写死了，编辑你的flume-ng脚本，查看第225行，如下图：

　　找到原因呢后，我们可以修改这个上面的配置文件（/soft/apache-flume-1.7.0-bin/bin/flume-ng，这个路径跟你安装flume的路径去找，推荐使用which，find命令将他找出来！）参数（JAVA_OPTS="-Xmx10240m"），我们将20M改为10G，具体操作如下：

　　当然，如果你不想修改默认的参数，我们也可以在启动的时候修改JVM的堆内存空间。我在命令行启动flume进程的时候手动分配Java的堆内存大小为2G，如下图：

三.缺少Hadoop的运行环境导致无法通过kafka将数据拷贝到hdfs中。

报错信息如下：

2018-10-17 13:06:45,287 (SinkRunner-PollingRunner-DefaultSinkProcessor) [WARN - org.apache.flume.sink.hdfs.BucketWriter.getRefIsClosed(BucketWriter.java:182)] isFileClosed is not available in the version of HDFS being used. Flume will not attempt to close files if the close fails on the first attempt
java.lang.NoSuchMethodException: org.apache.hadoop.fs.LocalFileSystem.isFileClosed(org.apache.hadoop.fs.Path)

　　遇到上面的这种情况，首先请确认你的hdfs的环境是否安装了，我的flume机器上仅仅部署了jdk和flume环境，其他的环境都没部署。如果你跟我一样没有部署的话，我给你个思路：

　　　　1>.去Apache官网下载和你集群中hdfs版本一致的包，安装到你的服务器上；（我cdh默认hdfs版本是2.6.0，于是我就去官网下载相应的包：https://archive.apache.org/dist/hadoop/common/hadoop-2.6.0/）

　　　　2>.安装过程很简单，解压即可，然后在“/etc/profile”这个配置文件中配置一下环境变了，最后别忘记将你要上传到hdfs集群中的配置文件(core-site.xml和hdfs-site.xml )拷贝一份到本地，将这两个配置文件覆盖到本地到配置文件,配置文件生效后，需要使用“source /etc/profile”命令来重新加载一个系统的环境变量的配置文件，配置完成后我们可以通过下面的命令查看hdfs的版本。

　　　　按照上述方法操作后，我们再次运行flume，发现不报错了，数据也开始在hdfs中写了，是不是没有报错信息了？没有报错就是最好的结果，如下图：

　　接下来我们去集群的webUI查看相应的文件是否生产，果不其然，文件已经写到hdfs中了：

四.broker节点时间不同步导致的

报错信息如下：

2018-10-18 16:28:37,329 (SinkRunner-PollingRunner-DefaultSinkProcessor) [INFO - org.apache.kafka.clients.consumer.internals.AbstractCoordinator$SyncGroupRequestHandler.handle(AbstractCoordinator.java:431)] SyncGroup for group flume-consumer-against_cheating_01 failed due to coordinator rebalance, rejoining the group
2018-10-18 16:28:37,957 (PollableSourceRunner-KafkaSource-kafkaSource) [WARN - org.apache.flume.channel.kafka.KafkaChannel$KafkaTransaction.doCommit(KafkaChannel.java:560)] Sending events to Kafka failed
java.util.concurrent.ExecutionException: org.apache.kafka.common.errors.TimeoutException: The request timed out.
at org.apache.kafka.clients.producer.internals.FutureRecordMetadata.valueOrError(FutureRecordMetadata.java:56)
at org.apache.kafka.clients.producer.internals.FutureRecordMetadata.get(FutureRecordMetadata.java:43)
at org.apache.kafka.clients.producer.internals.FutureRecordMetadata.get(FutureRecordMetadata.java:25)
at org.apache.flume.channel.kafka.KafkaChannel$KafkaTransaction.doCommit(KafkaChannel.java:552)
at org.apache.flume.channel.BasicTransactionSemantics.commit(BasicTransactionSemantics.java:151)
at org.apache.flume.channel.ChannelProcessor.processEventBatch(ChannelProcessor.java:194)
at org.apache.flume.source.kafka.KafkaSource.doProcess(KafkaSource.java:295)
at org.apache.flume.source.AbstractPollableSource.process(AbstractPollableSource.java:60)
at org.apache.flume.source.PollableSourceRunner$PollingRunner.run(PollableSourceRunner.java:133)
at java.lang.Thread.run(Thread.java:748)
Caused by: org.apache.kafka.common.errors.TimeoutException: The request timed out.

　　这个问题，困扰了我好久，百度谷歌接近2个小时，都没有找到答案，手动去kafka集群拉去数据也是可以正常拉去都，就是一直报上面都错误，最后我们运维小组都人一起在办公室帮我分析一下原因，我自己也纳闷，为什么上午还好好都，下午就不好使了。我一个同时说会不会是下午你让我同步Hadoop集群都时间了？导致这个错误都发生？我寻思了一番，于是重启了一下Hadoop集群，发现以上错误烟消云散啦！那么问题来了，为什么会这样的呢？

　　说到这，我们就不得不探讨一下Kafka的工作原理了。

即将上线的flume服务器面临的一系列填坑笔记的更多相关文章

即将上线的Spark服务器面临的一系列填坑笔记
即将上线的Spark服务器面临的一系列填坑笔记作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 把kafka和flume倒腾玩了,以为可以轻松一段时间了,没想到使用CDH部署的spa ...
即将上线的YARN服务器面临的一系列填坑笔记
即将上线的YARN服务器面临的一系列填坑笔记作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 折腾了一个星期,终于让开发将数据跑起来了,可通过yarn的webUI界面,发现这里的核心 ...
即将上线的Hive服务器面临的一系列填坑笔记
即将上线的Spark服务器面临的一系列填坑笔记作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.18/10/19 16:36:31 WARN metastore.ObjectSt ...
即将上线的Kafka服务器面临的一系列填坑笔记
即将上线的Kafka服务器面临的一系列填坑笔记作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.Kafka日志报错:[error] k.m.j.KafkaJMX$ - Fai ...
即将上线的Kafka 集群（用CM部署的）无法使用“--bootstrap-server”进行消费，怎么破？
即将上线的Kafka 集群(用CM部署的)无法使用“--bootstrap-server”进行消费,怎么破? 作者:尹正杰版权声明:原创作品,谢绝转载!否则将追究法律责任. 一.报错:org.a ...
http://182.92.241.20/mypro/login 偶的点金项目细化分包管理平台即将上线！！
http://182.92.241.20/mypro/login 偶的点金项目细化分包管理平台即将上线!! 敬请期待! 项目外包利器项目管理利器
<a href="javascript:void(0);" id='test' onclick="javascript:alert('即将上线，敬请期待！');"><em class="rmwd"></em>征稿平台</a>
<a href="javascript:void(0);" id='test' onclick="javascript:alert('即将上线,敬请期待!');&q ...
NGK生态商城即将上线官网，推动生态落地应用
NGK生态商城即将上线官网,以推动生态落地应用.此举意味着NGK生态将跻身区块链顶尖之列,同时,NGK代币.NGK Dapp游戏 "呼叫河马" 以及NGK DeFi项目Baccar ...
没想到即将上线的NGK生态应用这么厉害？！
话说这即将上线的NGK公链可不是闹着玩的,这条公链的蛰伏时间长达两年,恐怕这个准备时间,连最初的区块链1.0时代的项目都无法比拟,现在的话那都差太远了. 编程一段代码并不难,难的是耐得住赚快钱的心.人 ...

随机推荐

《Linux内核设计与实现》读书笔记 1&2
第一章 Linux内核简介 1.2追寻Linus足迹:linux简介 Linus开发.Linux是类Unix系统.Linux内核也是自由软件. 1.3操作系统和内核简介操作系统:在整个系统中负 ...
HttpServletResponse类学习
/*//2) 乱码的解决. //设置服务器输出的编码为UTF-8---在BaseServlet处已经已经进行了设置 response.setCharacterEncoding("UTF-8& ...
JavaScript的类、对象、原型、继承、引用
以CSS为例,有一种为所有class为"xxxx"的元素添加样式(外联样式),那么所有class为xxx的元素样式就会改变,在css中像下面这么写: <html> &l ...
Activiti解析.bpmn文件获得User Task节点的CandidateUsers特性的值
参考文档: http://www.cnblogs.com/mingforyou/p/5351332.html http://blog.csdn.net/jackyrongvip/article/det ...
WebPage设计专业术语
header footer master content placeholder breadcrumb 面包屑(breadcrumb)源于一个童话,在网站中就是一行层级属性链接组成的线性链接标示(我的 ...
Jmeter常见问题及场景应用
Jmeter作为工具来讲,已经是一个相对比较牛掰的工具,除了它能够支持那么多协议以及方法之外,更在与它的前置处理以及后置处理.同步监控的人性化.当然,所有的工具.框架都是作为业务的支撑,如果不能满足我 ...
webstrom 安装Babel
https://www.jianshu.com/p/b9bd2ec9ec80 https://www.cnblogs.com/zhishaofei/p/6061568.html https://blo ...
CodeGear RAD 2007 SP4 最新下载及破解
CodeGear RAD 2007 up4最新下载及破解官方http下载: http://altd.codegear.com/download/radstudio2007/CodeGearRADSt ...
微信小程序入門學習資料鏈接
https://blog.csdn.net/github_38847071/article/details/73250258 https://blog.csdn.net/lily2016n/artic ...
vue实现带规格商品的表格编辑
实现效果: 需求分析: 商品分为启用规格和未启用规格两种状态, 启用时显示带规格表格, 不启用时显示无规格价格规格大项最多添加两个, 比如 "颜色", "尺寸& ...

即将上线的flume服务器面临的一系列填坑笔记

即将上线的flume服务器面临的一系列填坑笔记的更多相关文章

随机推荐

热门专题