DStream是类似于RDD概念,是对数据的抽象封装.它是一序列的RDD,事实上,它大部分的操作都是对RDD支持的操作的封装,不同的是,每次DStream都要遍历它内部所有的RDD执行这些操作.它可以由StreamingContext通过流数据产生或者其他DStream使用map方法产生(与RDD一样) time属性对DStream而言非常重要,DStream里面的RDD就是通过某个时间间隔产生的,而且以产生的时间为索引.所以在访问DStream的某个RDD时,实际上是访问它在某个时间点的RDD…