測试集群简单介绍:一共同拥有4台机器:10.10.244.136、10.10.244.137、10.10.244.138、10.10.244.139。

10.10.244.136是管理节点。另外3台是存储节点。准备工作详情例如以下:

1 在四台机器上安装CentOS release 6.5 (Final)  64位(管理节点须要安装Mysql\Postgresql\redhat_lsb)

2 CDH5.2(包括了Spark1.1) YUM源搭建、CM5.2 YUM源搭建、impala2 YUM 源搭建

CDH5.2仓库地址:http://archive-primary.cloudera.com/cdh5/redhat/6/x86_64/cdh/5/

CM5.2仓库地址:http://archive.cloudera.com/cm5/redhat/6/x86_64/cm/5/

impala2仓库地址:http://archive-primary.cloudera.com/impala/redhat/6/x86_64/impala/2/

3 关闭4台机器的selinux

cd /etc/selinux; vi config;SELINUX=disabled(找到它,改动成这样)

4 关闭4台机器的iptables(防火墙。CentoOS7.0 中就不是它了,好像是firewalk)

chkconfig --level 35 iptables off;

5 改动四台机器的hostname分别为master01.pmsc.gov.cn、datanode01.pmsc.gov.cn、datanode02.pmsc.gov.cn、 datanode03.pmsc.gov.cn

cd /etc/sysconfig; vi network;HOSTNAME=master01.pmsc.gov.cn(类似于这样改动)

6 在4台机器分别创建cloudera用户

groupadd cloudera;useradd -g cloudera cloudera;passwd cloudera;

7 让4台机器上的cloudera用户能够无password获得sudo权限

cd /etc;chmod u+w sudoers;vi sudoers;cloudera    ALL=(ALL)   ALL;%cloudera    ALL=(ALL)NOPASSWD : ALL(这两句话加入在root    ALL=(ALL)       ALL下方);chmod u-w sudoers

8 在4台机器间配置cloudera用户的SSH无password通信

cd /etc;vi hosts;加入例如以下内容

10.10.244.136 master01.pmsc.gov.cn

   10.10.244.137 datanode01.pmsc.gov.cn

   10.10.244.138 datanode02.pmsc.gov.cn

   10.10.244.139 datanode03.pmsc.gov.cn

   10.10.244.129 archive.cloudera.com  (YUM源本地机器)

cd /home/cloudera/.ssh;rm -rf *;ssh-keygen -t rsa -P '';cat id_rsa.pub>>authorized_keys(在4台机器上运行同样的操作,合并authorized_keys文件内容,并覆盖每一个机器上的authorized_keys文件);chmod 600 authorized_keys;

9 在4台机器之间做时钟同步。保证时间的一致性(136 自己同步自己。其他机器同步136的时间。

136上的配置(/etc/ntp.conf)

#server 0.centos.pool.ntp.org iburst

            #server 1.centos.pool.ntp.org iburst

            #server 2.centos.pool.ntp.org iburst

            #server 3.centos.pool.ntp.org iburst

            server 127.127.1.0

            fudge 127.127.1.0 stratum 8

137\138\139上的配置(/etc/ntp.conf)

#server 0.centos.pool.ntp.org iburst

            #server 1.centos.pool.ntp.org iburst

            #server 2.centos.pool.ntp.org iburst

            #server 3.centos.pool.ntp.org iburst

            server 10.10.244.136

            fudge 10.10.244.136 stratum 8

136\137\138\139设置ntpd服务开机自启动

sudo chkconfig ntpd on

137\138\139上在cloudera用户下每天同步一次时间(使用crontab)

30 21 * * * sudo ntpdate 10.10.244.131

10 在4台机器上安装JDK(最小版本号1.7.0_67)

sudo vi /etc/profile;加入例如以下配置

export JAVA_HOME=/usr/local/jdk1.7.0_71

      export PATH=$JAVA_HOME/bin:$PATH

      export CLASSPATH=.:$JAVA_HOME/lib/dt.jar:$JAVA_HOME/lib/tools.jar

11 Mysql数据的安装配置

默认字符编码设置为utf-8:

[mysqld]

            character-set-server=utf8

             # Disabling symbolic-links is recommended to prevent assorted security risks

             symbolic-links=0

            [client]

            port = 3306

            socket = /var/lib/mysql/mysql.sock

            default-character-set=utf8

            [mysql]

            no-auto-rehash

            default-character-set=utf8

改动root账户password:update user set Password = Password('test') where Host = '%' and User = 'root';flush privileges;

开启远程登录:update user set host = ‘%’ where user = ‘root’;flush privileges;

改动数据文件存储位置:

[mysqld]

             datadir=/home/mysql

socket=/home/mysql/mysql.sock

设置开机自启动:sudo chkconfig mysqld on

CDH5.2+CM5.2+impala2+Spark1.1 集群搭建基础环境准备的更多相关文章

  1. hadoop 1.2 集群搭建与环境配置

    一.虚拟机环境 见我的另一篇博客http://www.cnblogs.com/xckk/p/6000881.html, 需要安装JDK环境,centos下安装JDK可参考: http://www.ce ...

  2. Spark1.3.1 On Yarn的集群搭建

    下面给出的是spark集群搭建的环境: 操作系统:最小安装的CentOS 7(下载地址) Yarn对应的hadoop版本号:Hadoop的Cloudera公司发行版Hadoop2.6.0-CDH5.4 ...

  3. Hadoop分布式集群搭建

    layout: "post" title: "Hadoop分布式集群搭建" date: "2017-08-17 10:23" catalog ...

  4. Hadoop+HBase 集群搭建

    Hadoop+HBase 集群搭建 1. 环境准备 说明:本次集群搭建使用系统版本Centos 7.5 ,软件版本 V3.1.1. 1.1 配置说明 本次集群搭建共三台机器,具体说明下: 主机名 IP ...

  5. 基于centos6.5 hbase 集群搭建

    注意本章内容是在上一篇文章“基于centos6.5 hadoop 集群搭建”基础上创建的 1.上传hbase安装包 hbase-0.96.2-hadoop2 我的目录存放在/usr/hadoop/hb ...

  6. Elasticsearch集群搭建及使用Java客户端对数据存储和查询

    本次博文发两块,前部分是怎样搭建一个Elastic集群,后半部分是基于Java对数据进行写入和聚合统计. 一.Elastic集群搭建 1. 环境准备. 该集群环境基于VMware虚拟机.CentOS ...

  7. zookeeper与卡夫卡集群搭建

    首先这片博客没有任何理论性的东西,只是详细说明kafka与zookeeper集群的搭建过程,需要三台linux服务器. java环境变量设置 zookeeper集群搭建 kafka集群搭建 java环 ...

  8. 大数据中Hadoop集群搭建与配置

    前提环境是之前搭建的4台Linux虚拟机,详情参见 Linux集群搭建 该环境对应4台服务器,192.168.1.60.61.62.63,其中60为主机,其余为从机 软件版本选择: Java:JDK1 ...

  9. zookeeper相关知识与集群搭建

    Zookeeper Zookeeper相关概念 Zookeeper概述 Zookeeper是一个分布式协调服务的开源框架,主要用来解决分布式集群中应用系统的一致性问题. Zookeeper本质上是一个 ...

随机推荐

  1. IN 查询时出现ORA-01795:列表中的最大表达式数为1000解决方法

    问题描写叙述: SQL进行IN查询时出现:java.sql.SQLException: ORA-01795: 列表中的最大表达式数为 1000 解决的方法: 问题原因是:SQL进行IN查询时.IN中的 ...

  2. Facebook 开源动画库 pop

    官网:https://github.com/facebook/pop Demo: https://github.com/callmeed/pop-playground 一:pop的基本构成: POPP ...

  3. Android网络:开发浏览器(二)——功能完善之书签功能

    经过上述的编写,基本的功能已经完成了,不过工具栏里面基本还是一片空白,只有一个刷新的功能,现在咱们就先完善这些功能(之前有朋友说来点图,那么这次我会截些图更好的来描述). 既然是浏览器,怎么能没有书签 ...

  4. PHP MySQL -处理语句

    PHP MySQL 预处理语句 预处理语句对于防止 MySQL 注入是非常有用的. 预处理语句及绑定参数 预处理语句用于执行多个相同的 SQL 语句,并且执行效率更高. 预处理语句的工作原理如下: 预 ...

  5. 通过Servlet生成验证码图片(转)

    原文地址:http://www.cnblogs.com/xdp-gacl/p/3798190.html 一.BufferedImage类介绍 生成验证码图片主要用到了一个BufferedImage类, ...

  6. EL运算符(web基础学习笔记十七)

    一.EL语法 1.1.语法结构 ${expression} 1.2.[]与.运算符 EL 提供.和[]两种运算符来存取数据. 当要存取的属性名称中包含一些特殊字符,如.或?等并非字母或数字的符号,就一 ...

  7. JSP实现数据传递(web基础学习笔记三)

    get和post的区别: JSP内置对象: 1)out内置对象:out内置对象是在JSP开发过程中使用得最为频繁的对象,然而其使用起来也是最简单的.out对象用于向客户端浏览器输出数         ...

  8. Linux下Tar压缩使用

    具体的可以在linux环境下 用tar --help查看详细说明格式:tar [option] file -c create create a new archive -x extract extra ...

  9. 导出CCS3.3数据及使用matlab处理的方法

    CCS3.3是一款DSP的集成开发环境(IDE).在做DSP开发时,为验证算法.经常须要使用matlab进行算法验证,验证算法就须要数据.因此,一种交互的方法是: 使用DSP开发板连接CCS 用CCS ...

  10. PHP中curl的使用

    cURL 函数 curl_close — 关闭一个cURL会话 curl_copy_handle — 复制一个cURL句柄和它的所有选项 curl_errno — 返回最后一次的错误号 curl_er ...