Hive 执行计划

执行语句

hive> explain select s.id, s.name from student s left outer join student_tmp st on s.name = st.name;

结果，红色字体为我添加的注释

hive> explain select s.id, s.name from student s left outer join student_tmp st on s.name = st.name;

OK

ABSTRACT SYNTAX TREE:

  (TOK_QUERY (TOK_FROM (TOK_LEFTOUTERJOIN (TOK_TABREF (TOK_TABNAME student) s) (TOK_TABREF (TOK_TABNAME student_tmp) st) (= (. (TOK_TABLE_OR_COL s) name) (. (TOK_TABLE_OR_COL st) name)))) (TOK_INSERT (TOK_DESTINATION (TOK_DIR TOK_TMP_FILE)) (TOK_SELECT (TOK_SELEXPR (. (TOK_TABLE_OR_COL s) id)) (TOK_SELEXPR (. (TOK_TABLE_OR_COL s) name)))))

STAGE DEPENDENCIES: “这个sql将被分成两个阶段执行。基本上每个阶段会对应一个mapreduce job，Stage-0除外。因为Stage-0只是fetch结果集，不需要mapreduce job”

  Stage- is a root stage

  Stage- is a root stage

STAGE PLANS:

  Stage: Stage-

    Map Reduce

      Alias -> Map Operator Tree: “map job开始”

        s

          TableScan

            alias: s “扫描表student”

            Reduce Output Operator “这里描述map的输出，也就是reduce的输入。比如key，partition，sort等信息。”

              key expressions: “reduce job的key”

                    expr: name

                    type: string

              sort order: + “这里表示按一个字段排序，如果是按两个字段排序，那么就会有两个+(++),更多以此类推”

              Map-reduce partition columns: “partition的信息，由此也可以看出hive在join的时候会以join on后的列作为partition的列，以保证具有相同此列的值的行被分到同一个reduce中去”

                    expr: name

                    type: string

              tag: 0 “用于标示这个扫描的结果，后面的join会用到它”

              value expressions: “表示select 后面的列”

                    expr: id

                    type: int

                    expr: name

                    type: string

        st

          TableScan “开始扫描第二张表，和上面的一样”

            alias: st

            Reduce Output Operator

              key expressions:

                    expr: name

                    type: string

              sort order: +

              Map-reduce partition columns:

                    expr: name

                    type: string

              tag:

      Reduce Operator Tree: “reduce job开始”

        Join Operator

          condition map:

               Left Outer Join0 to 1 “tag 0 out join tag 1”

          condition expressions: “这里也是描述select 后的列，和join没有关系。这里我们的select后的列是 s.id 和 s.name, 所以0后面有两个字段， 1后面没有”

             {VALUE._col0} {VALUE._col2} 

          handleSkewJoin: false

          outputColumnNames: _col0, _col2

          Select Operator

            expressions:

                  expr: _col0

                  type: int

                  expr: _col2

                  type: string

            outputColumnNames: _col0, _col1

            File Output Operator

              compressed: false

              GlobalTableId:

              table:

                  input format: org.apache.hadoop.mapred.TextInputFormat

                  output format: org.apache.hadoop.hive.ql.io.HiveIgnoreKeyTextOutputFormat

  Stage: Stage-

    Fetch Operator

      limit: -

Time taken: 0.216 seconds

Hive 执行计划的更多相关文章

hive执行计划简单分析
原始SQL: select a2.ISSUE_CODE as ISSUE_CODE, a2.FZQDM as FZQDM, a2.FZQLB as FZQLB, a2.FJJDM as FJJDM, ...
【转】Hive执行计划
执行语句 hive> explain select s.id, s.name from student s left outer join student_tmp st on s.name = ...
hive高阶1--sql和hive语句执行顺序、explain查看执行计划、group by生成MR
hive语句执行顺序 msyql语句执行顺序代码写的顺序: select ... from... where.... group by... having... order by.. 或者 from ...
hive sql 语句执行顺序及执行计划
hive 语句执行顺序 from... where.... select...group by... having ... order by... 执行计划 Map Operator Tree: Ta ...
Hive之执行计划分析(explain)
Hive是通过把sql转换成对应mapreduce程序,然后提交到Hadoop上执行,查看具体的执行计划可以通过执行explain sql知晓一条sql会被转化成由多个阶段组成的步骤,每个步骤有执行 ...
Hive底层原理：explain执行计划详解
不懂hive中的explain,说明hive还没入门,学会explain,能够给我们工作中使用hive带来极大的便利! 理论本节将介绍 explain 的用法及参数介绍 HIVE提供了EXPLAIN ...
Hive 执行作业时报错 [ Diagnostics: File file:/ *** reduce.xml does not exist FileNotFoundException: File file:/ ]
2019-03-10 本篇文章旨在阐述本人在某一特定情况下遇到 Hive 执行 MapReduce 作业的问题的探索过程与解决方案.不对文章的完全.绝对正确性负责. 解决方案 Hive 的配置文件 ...
Hive学习之路（二十）Hive 执行过程实例分析
一.Hive 执行过程概述 1.概述 (1) Hive 将 HQL 转换成一组操作符(Operator),比如 GroupByOperator, JoinOperator 等 (2)操作符 Opera ...
Hive（九）Hive 执行过程实例分析
一.Hive 执行过程概述 1.概述 (1) Hive 将 HQL 转换成一组操作符(Operator),比如 GroupByOperator, JoinOperator 等 (2)操作符 Opera ...

随机推荐

iOS关于RunLoop和Timer
RunLoop这个东西,其实我们一直在用,但一直没有很好地理解它,或者甚至没有知道它的存在.RunLoop可以说是每个线程都有的一个对象,是用来接受事件和分配任务的loop.永远不要手动创建一个run ...
MongoDB学习2
MongoDB学习(翻译2) C#驱动之LINQ教程介绍本教程涵盖了1.8发布版本对linq查询的支持. 开始本教程之前,你应该至少阅读下C#驱动教程关于C#驱动的介绍快速开始首先,添加下面命 ...
CSS border-radius 圆角
本文转自:http://www.kwstu.com/Admin/ViewArticle/201409151549476225 border-radius属性主要用于设置div圆角效果. 使用方法 bo ...
Qt在表格中加入控件
任务:使用QTableWidget动态生成表格,在每行的某两列中加入QComboBox下拉框控件和QPushButton按钮控件有添加,删除,编辑功能,每行的按钮可以浏览文件夹并选择文件 1.新建一 ...
sql编程 && 存储过程
sql 结构化查询语言是一种编程语言用于管理数据库的编程语言元素: 数据数据类型变量的数据类型就是字段的数据类型变 ...
Linux进程同步之POSIX信号量
POSIX信号量是属于POSIX标准系统接口定义的实时扩展部分.在SUS(Single UNIX Specification)单一规范中,定义的XSI IPC中也同样定义了人们通常称为System V ...
Cocos2d-x--Box2D使用GLES-Render.h渲染查看刚体
分为两部分:文件拷贝和代码实现 1.文件拷贝: 在TestCpp下找到GLES-Render.h和GLES-Render.cpp两个文件复制到G:\cocos2d-2.1rc0-x-2.1.3\co ...
OpenCV环境搭建
前言我在上本科时候曾经用过opencv,那时候还是1.x版本,还必须在linux下自己编译. 时过境迁,最近突然想起来写个小程序来分析图片,就又想起了opencv.现在已然是2.4的版本. 环境搭建 ...
npm scripts + webpack 实践经验（React、Nodejs）
最近用Webpack+npm scripts+Mongodb+Nodejs+React写了个后台项目,在用Webpack构建过程中遇到了许多坑,就写出来分享一下. 构建工具五花八门,想当年刚学会Gru ...
Android RecyclerView完全解析
RecyclerView完全解析 (一) 前言话说RecyclerView已经面市很久,也在很多应用中得到广泛的使用,在整个开发者圈子里面也拥有很不错的口碑,那说明RecyclerView拥有比Li ...

Hive 执行计划

Hive 执行计划的更多相关文章

随机推荐

热门专题