Spark Standalone模式伪分布式环境搭建

前提：安装好jdk1.7，hadoop

安装步骤：

1、安装scala

下载地址：http://www.scala-lang.org/download/

配置环境变量：

export SCALA_HOME=/..../scala

export PATH=.:$SCALA_HOME/bin ....

验证：scala -version

2、安装spark

使用自己编译过的对应自己hadoop的spark

配置环境变量：

export SPARK_HOME=/.../spark

export PATH=.:$SPARK_HOME/bin ....

修改spark配置文件：

1）$SPARK_HOME/conf/spark-env.sh

export SPARK_MASTER_IP=hadoop000

export SPARK_WORKER_CORES=1 #WorkNode分出几核给spark使用

export SPARK_WORKER_INSTANCES=1 #WorkNode使用几个spark实例，一般一个就行了

export SPARK_WORKER_MEMORY=1G #WorkNode分出多少内存给spark使用

export SPARK_WORKER_PORT=8888 #指定spark运行时的端口号

2）$SPARK_HOME/conf/slave.sh

配置worknode节点hostname，一行配置一个

3）$SPARK_HOME/conf/spark-defaults.conf （可选配置）

参数配置参见：http://spark.apache.org/docs/latest/configuration.html

spark.master spark://hadoop000:7077
spark.local.dir /home/spark/spark_shuffle/ #配置spark shuffle数据存放路径
spark.executor.memory 1g

3、启动spark

$SPARK_HOME下的sbin和bin说明：
sbin：存放的是启动和停止spark集群等的命令；
bin：存放的是应用程序（spark-shell）启动和停止等的命令。

启动spark集群（sbin目录下）：start-all.sh

启动后浏览器访问：http://hadoop000:8080/

注：hadoop000为hostname，配置的属性可以在4040端口查看到，形如：http://hadoop000:4040/environment/

启动spark-shell（bin目录下）：

1）单机启动方式：spark-shell

2）集群启动方式：

spark-shell --master spark://hadoop000:7077

默认情况下Application的Memory是512M，申请所有的CPU资源；

指定executor的memory和cpu core数：spark-shell --master spark://hadoop000:7077 --executor-memory 2g --total-executor-cores 1

注意：executor-memory是每个executor占用的，而executor-cores是所有executor一共占用

具体参数配置的来源：SparkSubmit.scala中的options属性

为了启动方便起见，可以将master配置到spark-defaults.conf中

spark.master spark://hadoop000:7077

再启动spark-shell时，只需要： spark-shell

如果要指定参数，则使用：spark-shell --executor-memory 2g --total-executor-cores 1

详细信息参见官方文档：http://spark.apache.org/docs/latest/spark-standalone.html#installing-spark-standalone-to-a-cluster

Spark Standalone模式伪分布式环境搭建的更多相关文章

hive-2.2.0 伪分布式环境搭建
一,实验环境: 1, ubuntu server 16.04 2, jdk,1.8 3, hadoop 2.7.4 伪分布式环境或者集群模式 4, apache-hive-2.2.0-bin.tar. ...
Hadoop学习笔记1：伪分布式环境搭建
在搭建Hadoop环境之前,请先阅读如下博文,把搭建Hadoop环境之前的准备工作做好,博文如下: 1.CentOS 6.7下安装JDK , 地址: http://blog.csdn.net/yule ...
Hadoop2.5.0伪分布式环境搭建
本章主要介绍下在Linux系统下的Hadoop2.5.0伪分布式环境搭建步骤.首先要搭建Hadoop伪分布式环境,需要完成一些前置依赖工作,包括创建用户.安装JDK.关闭防火墙等. 一.创建hadoo ...
【Hadoop】伪分布式环境搭建、验证
Hadoop伪分布式环境搭建: 自动部署脚本: #!/bin/bash set -eux export APP_PATH=/opt/applications export APP_NAME=Ares ...
大数据：Hadoop（JDK安装、HDFS伪分布式环境搭建、HDFS 的shell操作）
所有的内容都来源与 Hadoop 官方文档一.Hadoop 伪分布式安装步骤 1)JDK安装解压:tar -zxvf jdk-7u79-linux-x64.tar.gz -C ~/app 添加到系 ...
【Hadoop离线基础总结】CDH版本Hadoop 伪分布式环境搭建
CDH版本Hadoop 伪分布式环境搭建服务规划步骤第一步:上传压缩包并解压 cd /export/softwares/ tar -zxvf hadoop-2.6.0-cdh5.14.0.tar ...
CentOS7下Hadoop伪分布式环境搭建
CentOS7下Hadoop伪分布式环境搭建前期准备 1.配置hostname(可选,了解) 在CentOS中,有三种定义的主机名:静态的(static),瞬态的(transient),和灵活的(p ...
HDFS 伪分布式环境搭建
HDFS 伪分布式环境搭建作者:Grey 原文地址: 博客园:HDFS 伪分布式环境搭建 CSDN:HDFS 伪分布式环境搭建相关软件版本 Hadoop 2.6.5 CentOS 7 Oracle ...
Spark2.4.0伪分布式环境搭建
一.搭建环境的前提条件环境:ubuntu-16.04 hadoop-2.6.0 jdk1.8.0_161. spark-2.4.0-bin-hadoop2.6.这里的环境不一定需要和我一样,基本版 ...

随机推荐

Hibernate 抓取策略fetch-2 (批量抓取batch-size以及hibernate.jdbc.fetch_size、hibernate.jdbc.batch_size)
类关系: User N~1 Group 测试代码: System.out.println("1"); List stuList = session.createQuery(&quo ...
使用Cyclone IV控制DDR2
根据你的DDR2手册配置好megacore,megacore会生成一个example top: 在quartus中运行megacore生成的xxx_pin_assignments.tcl,指定DDR2 ...
bzoj3533: [Sdoi2014]向量集
Description 维护一个向量集合,在线支持以下操作:"A x y (|x|,|y| < =10^8)":加入向量(x,y);" Q x y l r (|x| ...
oracle desc 表结构
SQL> desc v$logfile; 名称是否为空? 类型 ----------------------------------------- -------- ------------- ...
用C#将输入的小写字母转化为大写字母
string A = "adsaf"; string B =""; B=A.ToUper();
黄聪：PHP5.6+7代码性能加速-开启Zend OPcache-优化CPU
说明 PHP 5.5+版本以上的,可以使用PHP自带的opcache开启性能加速(默认是关闭的).对于PHP 5.5以下版本的,需要使用APC加速,这里不说明,可以自行上网搜索PHP APC加速的方法 ...
XAMPP Error: Apache shutdown unexpectedly. 解决思路
我建议首先运行在cmd中运行 (安装目录)apache/bin/httpd.exe 之后就很好确定错误的具体原因了,而不是根据下面的那样猜端口,比如我遇到的问题,就是配置的路径不存在导致的. 参考资 ...
推荐一个css帮助手册的版本同时提供chm和在线
版本保持更新目录分类妥当查阅很方便就是习惯了jquery那种风格,略有不适应. 包括最新css3的内容网址: http://css.doyoe.com/ chm下载地址: http://css ...
android listView Exception
- ::-/com.tongyan.tutelage W/System.err﹕ java.text.ParseException: Unparseable date: ) - ::-/com.ton ...
Spring配置xml文件详解
<?xml version="1.0" encoding="UTF-8"?> <beans xmlns="http://www.sp ...

Spark Standalone模式伪分布式环境搭建

Spark Standalone模式伪分布式环境搭建的更多相关文章

随机推荐

热门专题