Spark standalone运行模式

Spark Standalone 部署配置

Standalone架构

手工启动一个Spark集群

https://spark.apache.org/docs/latest/spark-standalone.html

通过脚本启动集群

编辑slaves,其实把worker所在节点添加进去

配置spark-defaults.conf

启动集群（我这里是三节点集群）

在浏览器打开页面

修改 spark-env.sh 文件

先停止

在重新启动一下

再次访问网页

下面跑一个Job实例

./spark-submit --master spark://sparking:7077 --class org.apache.spark.examples.SparkPi ../lib/spark-examples-1.6.1-hadoop2.6.0.jar

从过程反馈信息可以看出来计算Pi的值

可以看到运行完成了。

从页面也可以看出来

Spark Standalone HA

官方参考地址

https://spark.apache.org/docs/latest/spark-standalone.html#high-availability

SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=ZOOKEEPER -Dspark.deploy.zookeeper.url=node1:2181,node2:2181 -Dspark.deploy.zookeeper.dir=/my-spark"

默认是这样连接的。

因为刚才修改了文件，现在把修改好的文件分发到另外两个节点去

scp -r spark-env.sh  spark@node1:/home/spark/app/spark-1.6.-bin-hadoop2./conf/

scp -r spark-env.sh  spark@node2:/home/spark/app/spark-1.6.-bin-hadoop2./conf/

然后重新启动一下

可以看到起来了

Spark Standalone 运行架构解析

Spark基本工作流程

Spark Local模式

Spark Local cluster 模式

Spark standalone 模式

Spark standalone 详细过程解析

Spark standalone 模式下运行WordCount

在IDEA里把写好的wordcount程序打包（我这里用的是scala版本写的）

可以看到打包成功！

参考代码

package com.gong.spark

import org.apache.spark.{SparkConf, SparkContext}

object MyWordCount {

 def main(args: Array[String]):Unit={

   //参数检查

 if(args.length<){

   System.err.println("Usage:MyWordCount <input> <output>")

   System.exit()

 }

   //获取参数

  val input=args()

  val output=args()

    //创建SparkContext

     val conf=new SparkConf().setAppName("myWordCount")

    val sc=new SparkContext(conf)

   //读取数据

  val lines=sc.textFile(input)

   //进行相关计算

  val resultRdd=lines.flatMap(_.split(" ")).map((_,)).reduceByKey(_+_)

   //保存结果

   resultRdd.saveAsTextFile(output)

   sc.stop()

 }

}

把包上传到集群上（用rz命令就可以了）

在这之前我已经在我的hdfs上上次了work.txt文件

下面在集群里跑一下程序

./spark-submit --master spark://sparking:7077 --class com.gong.spark.MyWordCount /home/spark/testspark/learning-spark-1.0-SNAPSHOT.jar  /home/spark/testspark/work.txt  /home/spark/testspark/result5

可以看到运行完成了（在这里我说下运行这个程序需要网络良好才可以，因为我的实验室的网络非常差，所以我试了好多次）！！！！！

在hdfs上查看运行结果

Spark standalone运行模式的更多相关文章

Spark standalone运行模式（图文详解）
不多说,直接上干货! 请移步 Spark standalone简介与运行wordcount(master.slave1和slave2) Spark standalone模式的安装(spark-1.6. ...
【原】Spark不同运行模式下资源分配源码解读
版权声明:本文为原创文章,未经允许不得转载. 复习内容: Spark中Task的提交源码解读 http://www.cnblogs.com/yourarebest/p/5423906.html Sch ...
Spark的运行模式详解
Spark的运行模式是多种多样的,那么在这篇博客中谈一下Spark的运行模式一:Spark On Local 此种模式下,我们只需要在安装Spark时不进行hadoop和Yarn的环境配置,只要将S ...
五、standalone运行模式
在上文中我们知道spark的集群主要有三种运行模式standalone.yarn.mesos,其中常被使用的是standalone和yarn,本文了解一下什么是standalone运行模式,它的运行流 ...
Spark的运行模式(1)--Local和Standalone
Spark一共有5种运行模式:Local,Standalone,Yarn-Cluster,Yarn-Client和Mesos. 1. Local Local模式即单机模式,如果在命令语句中不加任何配置 ...
Spark多种运行模式
1.测试或实验性质的本地运行模式(单机) 该模式被称为Local[N]模式,是用单机的多个线程来模拟Spark分布式计算,通常用来验证开发出来的应用程序逻辑上是否有问题. 其中N代表可以使用N个线程, ...
Spark的运行模式(2)--Yarn-Cluster和Yarn-Client
3. Yarn-Cluster Yarn是一种统一资源管理机制,可以在上面运行多种计算框架.Spark on Yarn模式分为两种:Yarn-Cluster和Yarn-Client,前者Driver运 ...
spark的运行模式
1.local(本地模式) 单机模式,通常用来测试将spark应用以多线程方式,直接运行在本地本地模式可以启动多个executor不过上限不能超过cpu数 2.standalone(独立模式) 独 ...
017 Spark的运行模式（yarn模式）
1.关于mapreduce on yarn 来提交job的流程 yarn=resourcemanager(RM)+nodemanager(NM) client向RM提交任务 RM向NM分配applic ...

随机推荐

JMeter传递JSON数据
步骤: 1.添加线程组.HTTP请求默认值.察看结果树等参考<JMeter实现bugfree登录接口测试>.这里不再赘述. 2.添加HTTP请求在Body Data中写上输入的参数.参数 ...
C语言基础:初级指针分类： iOS学习 c语言基础 2015-06-10 21:50 30人阅读评论(0) 收藏
指针:就是地址. & 取地址运算符 %p 打印地址占位符 int a=0; printf("%p ",&a); 指针变量:用来存放地址的变量定义: ...
PowerShell添加和部署WSP
SharePoint PowerShell在SharePoint Product列表里边,然后以管理员权限启动. 1. 添加Solution 到 SharePoint Farm. Add-SPSolu ...
CentOS7安装OpenStack(Rocky版)-09.安装Cinder存储服务组件（控制节点）
本文分享openstack的Cinder存储服务组件,cinder服务可以提供云磁盘(卷),类似阿里云云盘 ----------------------- 完美的分隔线 -------------- ...
本地和服务器(ubuntu)文件同步
秘钥登录远端服务器 rsync -avze 'ssh -i ./id_rsa' root@remoteIp:/xx/remotefile.txt ./localpath (./id_rsa为本地秘钥路 ...
WinFrom调试时，弹出你正在调试发布的版本
把下图这里改成DEBUG就好还有项目属性里面也要改一下问题解决!
有锁Iphone 3GS 6.0.1 降级刷到4.2.1 完美越狱+解锁
2012-12-20 百度空间所写前言:由于之前的3GS升级到6.0.1后会有重启之后无法打电话的情况,同学觉得这样很烦,搞得手机不像个手机了.但是这也是没办法的,毕竟是不完美越狱加软解锁的.于是, ...
mysql安装错误解决办法
在我们装mysql数据库时,出现安装失败是一件非常令人烦恼的事情,接下来小编就给大家带来在我们安装mysql数据库失败的一些解决方法,感兴趣的小伙伴们可以参考一下 mysql数据库安装不了了!my ...
test20180922 打铁的匠
题意分析法一:吉司机线段树这是一个在线的\(O( n + q \cdot \log^2 n)\)做法. 考虑维护节点到根的权值前缀和cost,那么查询的时候区间减去子树根节点的cost就是价值. ...
剑指offer-矩形覆盖-斐波那契数列(递归，递推)
class Solution { public: int rectCover(int number) { if(number==0 || number==1||number==2) return nu ...

Spark standalone运行模式

Spark standalone运行模式的更多相关文章

随机推荐

热门专题