Zeppelin的入门使用系列之使用Zeppelin来运行Spark SQL（四）

【Zeppelin的入门使用系列之使用Zeppelin来运行Spark SQL（四）】的更多相关文章

Zeppelin的入门使用系列之使用Zeppelin来运行Spark SQL（四）

不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin来创建临时表UserTable(三) 1. 运行年龄统计的Spark SQL (1) 输入Spark SQL时,必须在第一行输入%sql . %sql主要是告诉Zeppelin的解释器(Interpreter),后续输入的命令是Spark SQL. %sql select age,count(*) counts from UserTable group by age order by age (2) .显示年…

Zeppelin的入门使用系列之使用Zeppelin来创建临时表UserTable（三）

不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之使用Zeppelin运行shell命令(二) 我们必须要先使用Spark 语句创建临时表UserTable,后续才能使用Spark SQL进行数据分析以及数据可视化. 1.加载用户数据文件到userText var userText = sc.textFile("file:/home/hadoop/data/zeppelin/ml-100k/u.user") 2.创建UserTable类 UserTable类的字段:序号.…

Zeppelin的入门使用系列之使用Zeppelin运行shell命令（二）

不多说,直接上干货! 前期博客 Zeppelin的入门使用系列之创建新的Notebook(一) 接下来,我将以ml-100k数据集,示范如何使用Spark SQL进行数据分析与数据可视化因为 [hadoop@master zeppelin]$ pwd /home/hadoop/data/zeppelin [hadoop@master zeppelin]$ ll total -rw-rw-r-- hadoop hadoop Sep : ml-100k.zip [hadoop@master zep…

Spark入门实战系列--6.SparkSQL（下）--Spark实战应用

[注]该系列文章以及使用到安装包/测试数据可以在<倾情大奉送--Spark入门实战系列>获取 .运行环境说明 1.1 硬软件环境线程,主频2.2G,10G内存 l 虚拟软件:VMware® Workstation 9.0.0 build-812388 l 虚拟机操作系统:CentOS 64位,单核 l 虚拟机运行环境: Ø JDK:1.7.0_55 64位位) Ø Scala:2.10.4 Ø Spark:1.1.0(需要编译) Ø Hive:0.13.1 1.2 机器网络…

Zeppelin的入门使用系列之创建新的Notebook（一）

不多说,直接上干货! 前期博客 hadoop-2.6.0.tar.gz + spark-1.6.1-bin-hadoop2.6.tgz + zeppelin-0.5.6-incubating-bin-all.tgz(master.slave1和slave2)(博主推荐)(图文详解) hadoop-2.7.3.tar.gz + spark-2.0.2-bin-hadoop2.7.tgz + zeppelin-0.6.2-incubating-bin-all.tgz(master.slave1和sl…

Zeppelin的入门使用系列之创建新的Notebook

前期博客 hadoop-2.6.0.tar.gz + spark-1.6.1-bin-hadoop2.6.tgz + zeppelin-0.5.6-incubating-bin-all.tgz(master.slave1和slave2)(博主推荐)(图文详解) hadoop-2.7.3.tar.gz + spark-2.0.2-bin-hadoop2.7.tgz + zeppelin-0.6.2-incubating-bin-all.tgz(master.slave1和slave2)(博主推荐)…