Storm源码阅读之SpoutOutputCollector

不得不说storm是一个特别棒的实时计算框架。为了对后文理解的方便，先说几个storm中的术语:

Topology：拓扑图或者拓扑结构。在storm中它通过消息分组的分式连接Spout和Bolt节点定义了运算处理的拓扑结构。如下图:

那什么是Spout呢？

在计算任务需要的数据其实就是由Spout提供的，所以它可以说是Storm中的消息源，一般是从外部数据源（日志文件、数据库、消息队列等等）不间断地读取数据然后发送给tuple元组的。

那它是通过谁发送的呢？又是如何发送的呢？

这里我们先回答第一个问题，第二个问题以后解答。

好了上面说了那么多就是为了引出今天的任务:阅读SpoutOutputCollector源码。

在阅读之前，我们先明确一下SpoutOutputCollector到底是什么？其实从类名就能说出大概(不得不说老外写的代码的可读性真是好的没法说。这里啰嗦一句，

个人觉得这也是他们分享精神的体现，时刻记住方便给别人看。)，它就是Spout输出收集器。

那它到底能干些啥呢？请看代码:

1.ISpoutOutputCollector：是SpoutOutputCollector的接口

 public interface ISpoutOutputCollector {

     /**

         发送tuple消息,并返回起发送任务的task的序列号集合

     */

     List<Integer> emit(String streamId, List<Object> tuple, Object messageId);

     /**

     *与上述发送方法类似，只不过emitDirect方法是要指定接收端的task，让接收端特定的task接收消息。

     */

     void emitDirect(int taskId, String streamId, List<Object> tuple, Object messageId);

     /**

     *处理异常

     */

     void reportError(Throwable error);

 }

从上述接口ISpoutOutputCollector源码可以看出ISpoutOutputCollector中声明了3个方法，两个属于发送tuple元组的方法，他们之间的差异在上述注释中已说的很清楚，还有一个处理异常的方法。

2.SpoutOutputCollector:它实现了接口ISpoutOutputCollector

 public class SpoutOutputCollector implements ISpoutOutputCollector {

     ISpoutOutputCollector _delegate;

     public SpoutOutputCollector(ISpoutOutputCollector delegate) {

         _delegate = delegate;

     }

     /**

      * 指定一个streamid和message发射tuple消息并返回起发送消息的task的序号。当tuple消息完全处理了，就会回调ack方法,否则会回调fail方法。

      */

     public List<Integer> emit(String streamId, List<Object> tuple, Object messageId) {

         return _delegate.emit(streamId, tuple, messageId);

     }

     /**

      * emit(String streamId, List<Object> tuple, Object messageId)的重载方法，这没有指定streamid,故采用默认的streamid

      */

     public List<Integer> emit(List<Object> tuple, Object messageId) {

         return emit(Utils.DEFAULT_STREAM_ID, tuple, messageId);

     }

     /**

      * emit(String streamId, List<Object> tuple, Object messageId)

      *的重载方法，这没有指定streamid,故采用默认的streamid，因为没有messageid，故ack方法和fail方法不会被调用

      */

     public List<Integer> emit(List<Object> tuple) {

         return emit(tuple, null);

     }

     /**

      * emit(String streamId, List<Object> tuple, Object messageId)的重载方法，因为没有messageid，故ack方法和fail方法不会被调用

      */

     public List<Integer> emit(String streamId, List<Object> tuple) {

         return emit(streamId, tuple, null);

     }

     /**

      * 发射tuple消息，不过需要指定接收端的task来接收，并且输出必须声明为直接流，同时指定用来接收消息的task必须采用直接分组的方式来接收消息.

      *

      */

     public void emitDirect(int taskId, String streamId, List<Object> tuple, Object messageId) {

         _delegate.emitDirect(taskId, streamId, tuple, messageId);

     }

     /**

      * emitDirect(int taskId, String streamId, List<Object> tuple, Object messageId)的重载方法，采用默认的streamid

      */

     public void emitDirect(int taskId, List<Object> tuple, Object messageId) {

         emitDirect(taskId, Utils.DEFAULT_STREAM_ID, tuple, messageId);

     }

     /**

      * emitDirect(int taskId, String streamId, List<Object> tuple, Object messageId)的重载方法，因为没有指定的消息id，所以ack和fail方法就不会调用.

      */

     public void emitDirect(int taskId, String streamId, List<Object> tuple) {

         emitDirect(taskId, streamId, tuple, null);

     }

     /**

      * 该类提供的重载方法，因为没有指定的消息id，所以ack和fail方法就不会调用.

      */

     public void emitDirect(int taskId, List<Object> tuple) {

         emitDirect(taskId, tuple, null);

     }

     /**

      * 接口ISpoutOutputCollector中reportError的实现.

      */

     @Override

     public void reportError(Throwable error) {

         _delegate.reportError(error);

     }

 }

在SpoutOutputCollector类中，实现了消息发射的方法,并且还提供了多个重载方法方便用户使用。

Storm源码阅读之SpoutOutputCollector的更多相关文章

Apache Storm源码阅读笔记
欢迎转载,转载请注明出处. 楔子自从建了Spark交流的QQ群之后,热情加入的同学不少,大家不仅对Spark很热衷对于Storm也是充满好奇.大家都提到一个问题就是有关storm内部实现机理的资料比 ...
storm源码阅读笔记之任务调度算法
3种Scheduler概述 EventScheduler:将系统中的可用资源均匀地分配给需要资源的topology,其实也不是绝对均匀,后续会详细说明 DefaultScheduler:和Evenet ...
fw: 专访许鹏：谈C程序员修养及大型项目源码阅读与学习
C家最近也有一篇关于如何阅读大型c项目源代码的文章,学习..融合.. -------------------- ref:http://www.csdn.net/article/2014-06-05 ...
storm源码之storm代码结构【译】【转】
[原]storm源码之storm代码结构[译] 说明:本文翻译自Storm在GitHub上的官方Wiki中提供的Storm代码结构描述一节Structure of the codebase,希望对正 ...
【原】storm源码之storm代码结构【译】
说明:本文翻译自Storm在GitHub上的官方Wiki中提供的Storm代码结构描述一节Structure of the codebase,希望对正在基于Storm进行源码级学习和研究的朋友有所帮助 ...
storm源码之storm代码结构【译】
storm源码之storm代码结构[译] 说明:本文翻译自Storm在GitHub上的官方Wiki中提供的Storm代码结构描述一节Structure of the codebase,希望对正在基于S ...
【原】FMDB源码阅读（三）
[原]FMDB源码阅读(三) 本文转载请注明出处 —— polobymulberry-博客园 1. 前言 FMDB比较优秀的地方就在于对多线程的处理.所以这一篇主要是研究FMDB的多线程处理的实现.而 ...
【原】FMDB源码阅读（二）
[原]FMDB源码阅读(二) 本文转载请注明出处 -- polobymulberry-博客园 1. 前言上一篇只是简单地过了一下FMDB一个简单例子的基本流程,并没有涉及到FMDB的所有方方面面,比 ...
【原】FMDB源码阅读（一）
[原]FMDB源码阅读(一) 本文转载请注明出处 —— polobymulberry-博客园 1. 前言说实话,之前的SDWebImage和AFNetworking这两个组件我还是使用过的,但是对于 ...

随机推荐

python 最佳实践与资源汇总
python 最佳实践 (部分) 一. 结构化工程文件功能 README.rst readme LICENSE 许可证 setup.py 打包和发布管理 requirements.txt 开发依赖 ...
Python pycrypto 加密与解密
参考: python 使用 pycrypto‎ 实现 AES 加密解密参考: 分组对称加密模式:ECB/CBC/CFB/OFB 代码示例 : import hashlib from Crypto.C ...
jenkins管理员密码登录不了
1.密码管理员密码,如何修改进入/var/jenkins_home/users/admin目录下修改config.xml文件: 以下密码是admin <hudson.security.Huds ...
Linux网络服务12——NFS共享服务
Linux网络服务12--NFS共享服务一.NFS简介端口号:TCP.UDP 111端口 NFS(Network File System)网络文件系统,是一种基于TCP/IP传输的网络文件系统协议 ...
Python之数据加密与解密及相关操作（hashlib模块、hmac模块、random模块、base64模块、pycrypto模块）
本文内容数据加密概述 Python中实现数据加密的模块简介 hashlib与hmac模块介绍 random与secrets模块介绍 base64模块介绍 pycrypto模块介绍总结参考文档提 ...
在C#中初遇Socket - 1
后期项目实战:多人在线聊天室源码位置:https://git.oschina.net/z13qu/BlogProjects 课前须知这里不讲解Socket和TCP/IP的底层知识对于初学者来说底 ...
bc计算A股上市新股依次涨停股价
几年的股市可谓惨不忍睹,不提也罢.唯有打新中签的时候,心里稍微有那么一点点的补偿,于是内心就YY可以30板吗,可以40板吗.于是就写了个连板的bc程序,每次中签的时候就运行一下,然后尽情的YY,然而每 ...
dos命令窗口修改编码,CMD编码修改方法
dos命令窗口修改编码,CMD编码修改方法第一步,打开命令窗口有两种方法第一种:可以点击左下角的开始按钮,在运行里面输入CMD,然后敲回车2第二种:组合键WIN+R键,组合键后就会弹出窗口,然后输入 ...
AngularJS数据双向绑定
<body ng-app> <div ng-controller="myCtrl"> <input ng-model="abc" ...
邪恶改装2：用单片机实现一次简单的wifi密码欺骗
0×00 前言前段时间用TPYBoard v202 做了一个简单的WIFI干扰攻击器(ps :没有看过的小伙伴,可以看一下:http://www.freebuf.com/column/136985. ...

Storm源码阅读之SpoutOutputCollector

Storm源码阅读之SpoutOutputCollector的更多相关文章

随机推荐

热门专题