一、分布式HDFS的安装和启动

①在$HADOOP_HOME/etc/hadoop/core-site.xml文件

<configuration>

<property>

  <name>fs.defaultFS</name>

  <!-- 告知NN在哪个机器，NN使用哪个端口号接收客户端和DN的RPC请求. -->

  <value>hdfs://主机名:9000</value>

</property>

<property>

  <name>hadoop.tmp.dir</name>

  <value>/opt/module/hadoop-2.7.2/data/tmp</value>

</property>

</configuration>

②格式化Namenode（只需要格式化一次）

命令：hadoop namenode -format

目的： ①生成/opt/module/hadoop-2.7.2/data/tmp目录

②在目录中生成fsimage_0000000000000000000文件

③启动Namenode

hadoop-daemon.sh start namenode

启动datanode

hadoop-daemon.sh start datanode

④查看

Jps

通过浏览器访问 http://nn所在的主机名或ip:50070

如果NN和DN都在一台机器，且只有一个DN节点，称为伪分布式！

二、在YARN上运行MR

①修改 $HADOOP_HOME/etc/hadoop/mapred-site.xml文件

<property>

  <name>mapreduce.framework.name</name>

  <value>yarn</value>

</property>

②启动YARN

配置RM到底在哪个机器启动

修改 $HADOOP_HOME/etc/hadoop/yarn-site.xml文件

<property>

<name>yarn.resourcemanager.hostname</name>

<value>主机名</value>

</property>

<!-- reducer获取数据的方式 -->

<property>

 		<name>yarn.nodemanager.aux-services</name>

 		<value>mapreduce_shuffle</value>

</property>

③启动RM,NM

yarn-daemon.sh start resourcemanager

yarn-daemon.sh start nodemanager

④查看

jps

http://RM所运行的机器主机名/ip:8088

三、提交任务

hadoop jar jar包主类名参数{多个输入目录，一个输出目录}

输入目录中必须全部是文件！

输出目录必须不存在！

HDFS和MR的配置和使用的更多相关文章

高可用,完全分布式Hadoop集群HDFS和MapReduce安装配置指南
原文:http://my.oschina.net/wstone/blog/365010#OSC_h3_13 (WJW)高可用,完全分布式Hadoop集群HDFS和MapReduce安装配置指南 [X] ...
Hadoop HDFS安装、环境配置
hadoop安装进入Xftp将hadoop-2.7.3.tar.gz 复制到自己的虚拟机系统下的放软件的地方,我的是/soft/software 在虚拟机系统装软件文件里,进行解压缩并重命名进入p ...
CM记录-Hadoop 分布式文件系统HDFS（登录、配置、监控）
1.登录(浏览器输入ip地址:7180,登录用户名和登录密码即可) 2.CM主界面(各个组件,监控图表,绿色代表运行正常.黄色代表运行不良,需要关注根据实际情况调整,红色代表故障,需要排查问题) 3. ...
HDFS 的垃圾回收配置
HDFS的垃圾回收的默认配置的 0,也就是说,如果你不小心误删除了某样东西,那么这个操作是不可恢复的. 但是如果配置了HDFS的垃圾回收机制,那么删除的东西就可以在垃圾箱中保存一段你配置的时间,等 ...
HDFS Federation客户端(viewfs)配置攻略
转自:http://dongxicheng.org/hadoop-hdfs/hdfs-federation-viewfs/ 1. HDFS Federation产生背景在Hadoop 1.0中,HD ...
一梳理从 HDFS 到 MR。
MapReduce 不仅仅是一个工具,更是一个框架.我们必须拿问题解决方案去适配框架的 map 和 reduce 过程很多情况下,需要关注 MapReduce 作业所需要的系统资源,尤其是集 ...
Hadoop框架：HDFS高可用环境配置
本文源码:GitHub·点这里 || GitEE·点这里一.HDFS高可用 1.基础描述在单点或者少数节点故障的情况下,集群还可以正常的提供服务,HDFS高可用机制可以通过配置Active/Sta ...
can not create symbolic link HDFS解压自动配置lib报错。
如题,使用FusionInsight解压生成样例代码的时候报错,找不到解释.只猜测是权限问题.然后并没有仔细静心思考,心里杂念很多,很浮躁. 解决方法是“以管理员身份运行“. 想想高中:面对问题,不能 ...
Lucene搜索引擎+HDFS+MR完成垂直搜索
介于上一篇的java实现网络爬虫基础之上,这一篇的思想是将网络收集的数据保存到HDFS和数据库(Mysql)中:然后用MR对HDFS的数据进行索引处理,处理成倒排索引:搜索时先用HDFS建立好的索引来 ...

随机推荐

Mac下如何连接linux服务器（SSH）-比较好用的SSH工具推荐
Mac下如何连接linux服务器(SSH) 1.用mac自带终端连接步骤如下: 打开终端,在顶部shell菜单中选择新建远程连接在右侧服务器窗口点击+号,添加服务器,输入IP等信息输入用户名,点 ...
portapack h1 买回来刷hackrf与使用说明
买回来很兴奋,别着急,先不用装扩展板!刷好支持扩展屏的固件,才能用!-------------------------------------hackrf连接电脑windows系统win7/win10 ...
REDIS主从频繁切换事件排查
目录前言现象排查结论 redis主从配置注意点前言目前生产配置了2台redis一主一从1.193和12.6,和3个哨兵.1.193,3.10,12.6,搭建的redis高可用环境.突然发生 ...
ESXI多网卡网络配置
1.两台路由器接入不同网络: 2.一台4网口服务器,网口分别为:vmnic0.vmnic1.vmnic2.vmnic3 3.ESXI6.5服务器虚拟机系统测试环境模拟: 路由1:192.168.0. ...
09_EM算法
今天是2020年3月5日星期四.预计开学时间不会早于四月初,真是好消息,可以有大把的时间整理知识点(实际上发文章的时间都6月6号了,希望9月份能开学啊,不耽误找工作~).每次导师找,整个人会变的特别烦 ...
第03组团队Git现场编程实战
1.组员职责分工张逸杰:复制监督整个编程任务的进程以及协助组员编程黄智锋.刘汪洋:负责UI设计苏凯婷.鲍冰如:爬取数据并负责测评出福州最受欢迎的商圈陈荣杰.杨锦镔:爬取数据并负责测评出福州人均 ...
2020最新IDEA插件大集合，一款能帮助你写代码的工具是多么重要
摘要 12款为用户精心打造的Idea插件,含盖前后端,另把使用小技巧分享给大家,提高大家的码率,希望对你们有帮助! Lombok Lombok为Java项目提供了非常有趣的附加功能,使用它的注解可以有 ...
CentOS 7设置静态IP并修改DNS
1. 设置静态IP 首先需要确定网线插在服务器的哪一个网络接口上,接口旁边一般都有写.我这边是插在1号接口上的. 然后修改网络配置文件,文件位于 /etc/sysconfig/network-scri ...
PuTTY通过SSH连接上Ubuntu20.04
在PuTTY中连接到Ubuntu20.04大致需要几个步骤(不一定对应文本中的序号):1) 安装opensh-server (Ubuntu安装好之后 ,一般openssh-client自动已经安装好) ...
Jlink设置正确，但下载程序失败
[图中reset and run]勾选后即每次·下载程序后会自动复位,不需要再在硬件上进行复位各参数设置正确但依然下载失败. 原因是需要重新再编译一次,因为上次设置错误,编译后目标未创建! 重新编 ...

HDFS和MR的配置和使用

一、分布式HDFS的安装和启动

二、在YARN上运行MR

HDFS和MR的配置和使用的更多相关文章

随机推荐

热门专题