Apache Tez on hive

———————————————————— 调配 Hadoop ————————————————————

1 将编译好的 TEZ .tar.gz 文件上传到 HDFS 中。

hdfs fs -put complete-tez-0.7.0.tar.gz /tez

2 创建 tez-site.xml

需要在 hadoop 的 master 节点上面的 ${HADOOP_HOME}/etc/hadoop 目录下面创建一个 tez-site.xml 文件，里面填写如下内容

<?xml version="1.0" encoding="UTF-8"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

</property>

</configuration>

3 修改 hadoop-2.6.0/etc/hadoop/hadoop-env.sh

export TEZ_HOME=/usr/local/opt/tez-0.7.0

for jar in `ls $TEZ_HOME |grep jar`; do

export HADOOP_CLASSPATH=$HADOOP_CLASSPATH:$TEZ_HOME/$jar

done

for jar in `ls $TEZ_HOME/lib`; do

export HADOOP_CLASSPATH=$HADOOP_CLASSPATH:$TEZ_HOME/lib/$jar

done

以上完成了tez的基本配置，接下来有 2 中方法使我们的任务运行在tez上，一种修改

mapreduce-site.xml 设置 yarn 改为 yarn-tez

第二种，修改 hive 直接运行在 tez 上

第三种 hive set tez

———————————————————— hive on tez （单个 job 运行 Tez） ————————————————————

1 将编译好的 tez（编译成功的包会放在tez-dist/target ）所有jar 包放入 hive下。

     find . -name "*jar" -print | cp -a `xargs` tezlib/ 
     上面命令得到 tez 所有jar 包。

2  hive on tez 的使用方式 配置好以后 进入 hive

hive (default)>set hive.execution.engine=tez;
set hive.execution.engine=mr 或退出 hive 即可

3 如果 hive set tez 后运行异常可以启用调试模式启动hive (linux 下进入 hive 启动模式)

hive -hiveconf hive.root.logger=DEBUG,console

—————————————————— Hive on tez 性能测试——————————————————

性能测试：

select a.sex ,b.age , c.* from a join b on a.sex = b.sex join c on a.id ;

3表各1万 / 169kb

Hive on MapReduce

39分钟 = =！

hive on tez

25分钟（未发挥最佳性能，因为数据量大量的 IO 都是拉取。并无多 MR）

set hive.execution.engine=tez;

实验 a 164M b 164M c 1.7G d 164M, e 164M

————————————————   hive on MR 3 分 9 秒  ————————————————

————————————————  hive on tez 22.5 秒  ————————————————

———————————————————— hive on tez （所有 job 运行 Tez） ————————————————————

Tez部署完毕后，下载hive0.14.0的二进制文件，解压即可。然后在hive的conf目录下新建hive-site.xml进行常规的配置，如果要是此hive运行在tez上，可以在配置文件中加上：

<name>mapreduce.framework.name</name>

</property>

当然这个配置也能加在mapsite.xml里，建议加在需要hive-site.xml以不影响集群其他hive。

然后打开命令行，首先执行set hive.execution.engine=tez; 这里说下这个配置的含义，

Setting execution engine to mr and framework name to yarn = Hive compiles to MR and runs on MR.

Setting execution engine to mr and framework name to yarn-tez = Hive compiles to MR and runs on Tez.

Setting execution engine to tez = Hive compiles to Tez and runs on Tez.

Apache Tez on hive的更多相关文章

Apache Tez 了解
你可能听说过Apache Tez,它是一个针对Hadoop数据处理应用程序的新分布式执行框架.但是它到底是什么呢?它的工作原理是什么?哪些人应该使用它,为什么?如果你有这些疑问,那么可以看一下Bika ...
Apache Tez Design
http://tez.incubator.apache.org/ http://dongxicheng.org/mapreduce-nextgen/apache-tez/ http://dongxic ...
Apache Hudi 与 Hive 集成手册
1. Hudi表对应的Hive外部表介绍 Hudi源表对应一份HDFS数据,可以通过Spark,Flink 组件或者Hudi客户端将Hudi表的数据映射为Hive外部表,基于该外部表, Hive可以方 ...
CentOS 6.5 Maven 编译 Apache Tez 0.8.3 踩坑/报错解决记录
最近准备学习使用Tez,因此从官网下载了最新的Tez 0.8.3源码,按照安装教程编译使用.平时使用的集群环境是离线的,本打算这一次也进行离线编译,无奈一编译就开始报缺少jar包的错,即使手动下载ja ...
Caused by: java.sql.SQLException: Failed to start database 'metastore_db' with class loader org.apache.spark.sql.hive.client.IsolatedClientLoader$$anon$1@d7c365, see the next exception for details.
解决方法:https://stackoverflow.com/questions/37442910/spark-shell-startup-errors 异常: 18/01/29 19:04:27 W ...
Apache ranger整合hive报错记录
版本信息如下: hadoop2.9.2 hive 2.x ranger 最新版2.1.0 在hive端部署完ranger 插件以后,在使用beeline连接查询数据库时报错,报错信息如下: verbo ...
local模式运行spark-shell时报错 java.lang.IllegalArgumentException: Error while instantiating 'org.apache.spark.sql.hive.HiveSessionState':
先前在local模式下,什么都不做修改直接运行./spark-shell 运行什么问题都没有,然后配置过在HADOOP yarn上运行,之后再在local模式下运行出现以下错误: java.lang. ...
Apache Tez 0.7、0.83、 0.82 安装、调试笔记
———————————————————— 准备 Tez 编译环境 ———————————————————— 1 需要的支持 tez0.7 需要 Hadoop 2.60 以上 2 需要的 linux 相 ...
apache开源项目--HIVE
Hive是一个基于Hadoop的数据仓库平台.通过hive,我们可以方便地进行ETL的工作.hive定义了一个类似于SQL的查询语言:HQL,能够将用户编写的QL转化为相应的Mapreduce程序基 ...

随机推荐

java书籍推荐：《Java SE 6 技術手册》
Java SE 6 技術手册或 Java SE 6 技術手册 Java SE 6 技術手册為什麼選擇用 Markdown?仅仅是單純把文件又一次排版太無聊了,不如趁這個機會學些新東西.所以我就藉 ...
沃通SSL精灵，让站点HTTPS永只是期
告别HTTP明文"裸奔"时代百度.阿里巴巴.必应等越来越多的互联网巨头相继启用全站HTTPS加密,保护用户数据和隐私安全.逐步告别HTTP明文"裸奔"时代. ...
Chromium网页输入事件捕捉和手势检測过程分析
连续的输入事件可能会产生一定的手势操作.比如滑动手势和捏合手势. 在Chromium中,网页的输入事件是在Browser进程中捕捉的.Browser进程捕获输入事件之后,会进行手势操作检測.检測出来的 ...
iOS 常见面试图总结2
1.请简述storyboard和xib的差别? 一个project中.能够有多个xib文件,一个xib文件相应着一个视图类控制器,和多个视图. 然而.使用 storyboard时,一个project仅 ...
[Tomcat]Tomcat6和Tomcat7的区别
Tomcat 7最大的改进是对Servlet 3.0和Java EE 6的支持.◆Tomcat 7完全支持Servlet 3.0规范◆Tomcat 7新增了对Java注释的支持◆Tomcat 7通过w ...
33.Qt模型与视图
#include "mainwindow.h" #include <QApplication> #include <QAbstractItemModel> ...
初涉springboot
1.首先,我们需要了解微服务是什么? 微服务 (Microservices) 是一种软件架构风格,它是以专注于单一责任与功能的小型功能区块 (Small Building Blocks) 为基础,利用 ...
关于1-n任意的gcd的和
gcd和题目 GCD sum 公约数的和大意是让你求1-n任意两个数的gcd的和之类的. 解法显然你需要枚举对吧,不然你怎么可能求出gcd呢? 其次我们需要一些数学推理令F(n)表示\(\su ...
MongoDB在MacOS上的客户端Robo 3T 的简单使用(二)
最近写了一个用node来操作MongoDB完成增.删.改.查.排序.分页功能的示例,并且已经放在了服务器上地址:http://39.105.32.180:3333. 本篇文章只做简单介绍,能够使用起来 ...
mobiscroll插件的基本使用方法
前一阵子接触到了mobiscroll插件,用在移动端的日期选择上,感觉倍棒,于是便敲了一个小案例,与大家一起分享分享 <!DOCTYPE html> <html lang=" ...

Apache Tez on hive

Apache Tez on hive的更多相关文章

随机推荐

热门专题