Oozie_示例
Oozie 官方示例
解压oozie-examples.tar.gz
将examples/上传到HDFS家目录
$ bin/hdfs dfs -put /opt/cdh-5.6.3/oozie-4.0.0-cdh5.3.6/examples examples
试运行自带的wordcount示例examples/apps/map-reduce
job-with-config-class.properties
job.properties
lib
workflow-with-config-class.xml
workflow.xml
修改example下/opt/cdh-5.6.3/oozie-4.0.0-cdh5.3.6/examples/apps/map-reduce/
job.properties
nameNode=hdfs://hadoop09-linux-01.ibeifeng.com:8020
jobTracker=hadoop09-linux-01.ibeifeng.com:8032
功能: 指定workflow的地址,声明相关变量
workflow.xml
引用job.properties相关变量
配置工作流
运行一下
$ bin/oozie job -oozie http://hadoop09-linux-01.ibeifeng.com:11000/oozie -config examples/apps/map-reduce/job.properties -run
8088端口会出现两个执行进程,其中一个是launch仅仅执行map程序用于封装oozie
第二个进行执行mr程序
wf运行流程
command 提交任务
oozie读取job.properties
查找需要运行的wf的地址,将相应变量传递给wf
读取wf文件
start 节点
action 节点
OK -> end
error -> kill
读取依赖的jar包(lib目录)
sharelib的jar包支持
自定义实现workcount的workflow
测试wordcount程序
$ bin/yarn jar share/hadoop/mapreduce/hadoop-mapreduce-examples-2.5.0-cdh5.3.6.jar wordcount /input /output
也可用hadopp示例的wordcount
oozie根目录下创建application文件夹,并将examples/apps/map-reduce/复制一份到application,用于配置自定义wordcount程序
上传application文件夹到hdfs(家目录,因为在job.properties下要配置该目录)
添加,修改applicatio/wc-wf目录下配置文件
job.properties
examplesRoot=application/wc-wf
inputDir=input
outputDir=output
workflow.xml
<delete path="${nameNode}/${outputDir}"/>
mapreduce.job.queuename=${queueName}
mapreduce.job.map.class=org.apache.hadoop.wordcount.WCMap
mapreduce.job.reduce.class=org.apache.hadoop.wordcount.WCReduce
mapreduce.map.output.key.class=org.apache.hadoop.io.Text
mapreduce.map.output.value.class=org.apache.hadoop.io.LongWritable
mapreduce.job.output.key.class=org.apache.hadoop.io.Text
mapreduce.job.output.value.class=org.apache.hadoop.io.LongWritable
mapreduce.input.fileinputformat.inputdir=${nameNode}/${inputDir}
mapreduce.output.fileoutputformat.outputdir=${nameNode}/${outputDir}
与mr程序中的driver如出一辙
将复制的application/wc-wf中的lib目录下jar包删除,并把wc.jar放入
重新上传文件运行
$ export OOZIE_URL="http://hadoop09-linux-01.ibeifeng.com:11000/oozie"
$ bin/oozie job -config application/wc-wf/job.properties -run
oozie 任务被kill
查看log日志发现 java.io.IOException: mapreduce.job.map.class is incompatible with map compatability mode
原因没使用 mapred.mapper.new-api = true 与 mapred.reducer.new-api = true
自定义shell的workflow
从example示例中复制一份shell到application,更名为shell-wf
在shell-wf目录中
创建一个shell脚本,简单测试
$HIVE_HOME/bin/hive -e "show databases" >> shell-rs.txt
依据官网文档修改部分配置
job.properties
nameNode=hdfs://hadoop09-linux-01.ibeifeng.com:8020
jobTracker=hadoop09-linux-01.ibeifeng.com:8032
queueName=default
examplesRoot=user/liuwl/application/shell-wf
EXEC=test.sh
oozie.wf.application.path=${nameNode}/${examplesRoot}/workflow.xml
workflow.xml
exec节点后添加
<file>${nameNode}/${examplesRoot}/${EXEC}#${EXEC}</file>
修改ok节点to end节点
上传shell-wf目录到hdfs
测试运行
$ export OOZIE_URL="http://hadoop09-linux-01.ibeifeng.com:11000/oozie"
$ bin/oozie job -config application/wc-wf/job.properties -run
复杂DAG图设计(其实也就是顺序,并发执行多个job)
|----> hive action -->|
start --> MR action --> shell action --> end
|----> spark action -->|
一个简单的workflow: 先执行mraction 运行wordcount程序,然后使用shellaction 移动output下的part文件
复制一份上面的wc-wf文件夹
创建一个shel脚本
#!/bin/bash
HADOOP_HOME=/opt/cdh-5.6.3/hadoop-2.5.0-cdh5.3.6
$HADOOP_HOME/bin/hdfs dfs -mv /output/p* /
修改job.properties与workflow.xml
nameNode=hdfs://hadoop09-linux-01.ibeifeng.com:8020
jobTracker=hadoop09-linux-01.ibeifeng.com:8032
queueName=default
examplesRoot=user/liuwl/application/dag-wf
oozie.wf.application.path=${nameNode}/${examplesRoot}/workflow.xml
inputDir=input
outputDir=output
EXEC=oozie.sh
=====================================================================
添加
<action name="shell-node">
<shell xmlns="uri:oozie:shell-action:0.2">
<job-tracker>${jobTracker}</job-tracker>
<name-node>${nameNode}</name-node>
<configuration>
<property>
<name>mapred.job.queue.name</name>
<value>${queueName}</value>
</property>
</configuration>
<exec>${EXEC}</exec>
<file>${nameNode}/${examplesRoot}/${EXEC}#${EXEC}</file>
</shell>
<ok to="end"/>
<error to="fail"/>
</action>
修改mr-node节点下OK节点为shell-node
测试运行
$ export OOZIE_URL="http://hadoop09-linux-01.ibeifeng.com:11000/oozie"
$ bin/oozie job -config application/dag-wf/job.properties -run
coordinator的编写
基于时间的任务调度(起始时间,终止时间,频率)
关于时区
CST 中国标准时间(China Standard Time)
UTC 协调世界时,又称世界标准时间
GMT 格林日志标准时间
OOZIE默认UTC与GMT本地时间相同,需要改为CST
使用date -R查看 是否为+0800
如果不是
cp /usr/zoneinfo/Asia/Shanghai /etc/localtime # ln -sf ... 或创建软连接
然后修改一下clock文件
vi /etc/sysconfig/clock
ZONE="Asia/Shanghai"
修改oozie的时区
oozie.site.xml
oozie.processing.timezone=GMT+0800
修改ext中js文件
oozie-server/webapps/oozie/oozie-console.js
查找GMT并修改为GMT+0800
重启oozie,清缓存查看页面
拷贝官方示例中的cron并修改
其中
job.properties
nameNode=hdfs://hadoop09-linux-01.ibeifeng.com:8020
jobTracker=hadoop09-linux-01.ibeifeng.com:8032
queueName=default
examplesRoot=user/liuwl/application/cron-wf
oozie.coord.application.path=${nameNode}/${examplesRoot}
start=2016-11-23T17:15+0800
end=2016-11-23T17:20+0800
workflowAppUri=${nameNode}/${examplesRoot}
coordinator.xml
<coordinator-app name="cron-coord" frequency="${coord:minutes(1)}"
start="${start}" end="${end}" timezone="GMT+0800" xmlns="uri:oozie:coordinator:0.2">
执行顺序
job.properties-->coordinator.xml(完成时间封装)-->workflow.xml(运行)
上传并测试运行
$ export OOZIE_URL="http://hadoop09-linux-01.ibeifeng.com:11000/oozie"
$ bin/oozie job -config application/cron-wf/job.properties -run
问题,运行后报错,提示频率值太小,修改
oozie-site.xml添加下
oozie.service.coord.check.maximum.frequency=false
再测试一个使用linux crontb格式的coordinator,改一下coordinator.xml如frequency="*/2 * * * *"
Oozie_示例的更多相关文章
- Swift3.0服务端开发(一) 完整示例概述及Perfect环境搭建与配置(服务端+iOS端)
本篇博客算是一个开头,接下来会持续更新使用Swift3.0开发服务端相关的博客.当然,我们使用目前使用Swift开发服务端较为成熟的框架Perfect来实现.Perfect框架是加拿大一个创业团队开发 ...
- .NET跨平台之旅:将示例站点升级至 ASP.NET Core 1.1
微软今天在 Connect(); // 2016 上发布了 .NET Core 1.1 ,ASP.NET Core 1.1 以及 Entity Framework Core 1.1.紧跟这次发布,我们 ...
- 通过Jexus 部署 dotnetcore版本MusicStore 示例程序
ASPNET Music Store application 是一个展示最新的.NET 平台(包括.NET Core/Mono等)上使用MVC 和Entity Framework的示例程序,本文将展示 ...
- WCF学习之旅—第三个示例之四(三十)
上接WCF学习之旅—第三个示例之一(二十七) WCF学习之旅—第三个示例之二(二十八) WCF学习之旅—第三个示例之三(二十九) ...
- JavaScript学习笔记(一)——延迟对象、跨域、模板引擎、弹出层、AJAX示例
一.AJAX示例 AJAX全称为“Asynchronous JavaScript And XML”(异步JavaScript和XML) 是指一种创建交互式网页应用的开发技术.改善用户体验,实现无刷新效 ...
- XAMARIN ANDROID 二维码扫描示例
现在二维码的应用越来越普及,二维码扫描也成为手机应用程序的必备功能了.本文将基于 Xamarin.Android 平台使用 ZXing.Net.Mobile 做一个简单的 Android 条码扫描示 ...
- iOS之ProtocolBuffer搭建和示例demo
这次搭建iOS的ProtocolBuffer编译器和把*.proto源文件编译成*.pbobjc.h 和 *.pbobjc.m文件时,碰到不少问题! 搭建pb编译器到时没有什么问题,只是在把*.pro ...
- Android种使用Notification实现通知管理以及自定义通知栏(Notification示例四)
示例一:实现通知栏管理 当针对相同类型的事件多次发出通知,作为开发者,应该避免使用全新的通知,这时就应该考虑更新之前通知栏的一些值来达到提醒用户的目的.例如我们手机的短信系统,当不断有新消息传来时,我 ...
- oracle常用函数及示例
学习oracle也有一段时间了,发现oracle中的函数好多,对于做后台的程序猿来说,大把大把的时间还要学习很多其他的新东西,再把这些函数也都记住是不太现实的,所以总结了一下oracle中的一些常用函 ...
随机推荐
- HSSFWorkBooK用法
public ActionResult excelPrint() { HSSFWorkbook workbook = new HSSFWorkbook();// 创建一个Excel文件 HSSFShe ...
- c#程序如何从海康ipserver查询获取DVR设备ip地址
海康威视提供的ipserver可以记录DVR设备的IP地址,并提供一个7071的端口给客户端查询用,我们在c#程序中可以用海康SDK包中的NET_DVR_GetDVRIPByResolveSvr函数来 ...
- POI完美解析Excel数据到对象集合中(可用于将EXCEL数据导入到数据库)
实现思路: 1.获取WorkBook对象,在这里使用WorkbookFactory.create(is); // 这种方式解析Excel.2003/2007/2010都没问题: 2.对行数据进行解析 ...
- seo优化urlrewrite伪静态技术
1.下载urlrewrite-3.2.0.jar 2.在WEB-INF下增加urlrewrite.xml <?xml version="1.0" encoding=" ...
- IBM CLI 和 ODBC
Installing and Configuring DB2 Clients Running CLI/ODBC Programs The DB2 Call Level Interface (CLI) ...
- C#中常用的系统内置委托
在公共语言运行时(CLR)环境中系统为我们内置了一些常用的委托,包括Action类的委托.Func类的委托.Predicate<T>委托.Comparison<T>委托等等.以 ...
- 【DWR系列02】-DWR逆向Ajax即服务器推送
.literal { background-color: #f2f2f2; border: 1px solid #cccccc; padding: 1px 3px 0; white-space: no ...
- 让Fiddler 直接抓取java程序的方法
Fiddler官网给出的解决办法(见http://www.fiddler2.com/fiddler/help/hookup.asp#Q-JavaTraffic)是设置jvm参数,如 jre -Dpro ...
- 第五篇:在SOUI中使用XML布局属性指引(pos, offset, pos2type)
窗口布局的概念 每一个UI都是由大量的界面元素构成的,在Windows编程,这些界面元素的最小单位通常称之为控件. 布局就是这些控件在主界面上的大小及相对位置. 传统的布局一般使用一个4个绝对坐标来定 ...
- Mvc 之System.Web.Optimization 压缩合并如何让*.min.js 脚本不再压缩
最近项目中用到了easy ui ,但是在配置BundleConfig 的时候出现了问题,easy ui的脚本jquery.easyui.min.js 压缩后出现各种脚本错误,总是莫名其妙的 i标量错误 ...