新手刚开始学习比较迷茫,参考下面,然后找相关资料学习

1 Spark基础篇  
    1.1 Spark生态和安装部署  
        在安装过程中,理解其基本操作步骤。  
        安装部署  
          Spark安装简介  
          Spark的源码编译  
          Spark Standalone安装  
          Spark Standalone HA安装  
          Spark应用程序部署工具spark-submit  
        Spark生态  
          Spark(内存计算框架)  
          SparkSteaming(流式计算框架)  
          Spark SQL(ad-hoc)  
          Mllib(Machine Learning)  
          GraphX(bagel将被取代)  
    1.2 Spark运行架构和解析  
        Spark的运行架构  
          基本术语  
          运行架构  
          Spark on Standalone运行过程  
          Spark on YARN 运行过程  
        Spark运行实例解析  
          Spark on Standalone实例解析  
          Spark on YARN实例解析

1.3 Spark的监控和调优  
        Spark的监控  
          Spark UI监控,默认端口是4040  
          Ganglia 监控,大数据监控开源框架  
        Spark调优  
          基础性调优方式  
    1.4 Spark编程模型       
        Spark的编程模型  
          Spark编程模型解析  
          RDD的特点、操作、依赖关系  
          Spark应用程序的配置  
        Spark编程实例解析  
          日志的处理  
    1.5 Spark Streaming原理       
          Spark流式处理架构  
          DStream的特点  
          Dstream的操作和RDD的区别  
          Spark Streaming的优化  
        Spark Streaming实例分析  
          常用的实例程序:  
                  文本实例  
                  Window操作  
                  网络数据处理  
    1.6 Spark SQL原理  
          Spark SQL的Catalyst优化器  
          Spark SQL内核  
          Spark SQL和Hive      
        Spark SQL的实例  
          Spark SQL的实例操作demo  
          Spark SQL的编程,需要网络上查找一些资源

2 中级篇  
    2.1 Spark的多语言编程   
        Spark的scala编程  
        Spark的Python编程(Java一定熟悉啦,不用多说了)  
           对应的应用程序实例,理解基本的处理模式。

2.2 Spark 机器学习入门  
        机器学习的原理  
        Mllib简介,实例分析  
    2.3 GraphX 入门  
        图论基础  
        GraphX的简介  
        GraphX例程分析  
    2.4 理解Spark与其它项目的区别和联系  
        Spark和MapReduce、Tez  
        Spark的衍生项目BlinkDB,RSpark  
    2.5 关注Spark的作者的blog和权威网站的文档

3 高级篇  
   3.1 深入理解Spark的架构和处理模式

3.2 Spark源码剖析与研读  
        Spark Core核心模块,  
        掌握下面核心功能的处理逻辑:  
            SparkContext   
            Executor  
            Deploy  
            RDD和Storage  
            Scheduler和Task  
        Spark Examples  
    3.3 思考如何优化和提升,掌握其优缺点,  
        深入思考能不能衍生出有意思的课题。

Spark学习体系整理(基础篇、中级篇、高级篇所涉及内容)的更多相关文章

  1. Spark学习体系

    底理解Spark,能够分为以下几个层次. 1 Spark基础篇 1.1 Spark生态和安装部署 在安装过程中,理解其基本操作步骤. 安装部署 Spark安装简单介绍 Spark的源代码编译 Spar ...

  2. #Java学习之路——基础阶段二(第二篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  3. #Java学习之路——基础阶段(第三篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  4. #Java学习之路——基础阶段二(第九篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  5. #Java学习之路——基础阶段二(第一篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  6. #Java学习之路——基础阶段(第十一篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  7. #Java学习之路——基础阶段(第十篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  8. #Java学习之路——基础阶段(第八篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

  9. #Java学习之路——基础阶段(第七篇)

    我的学习阶段是跟着CZBK黑马的双源课程,学习目标以及博客是为了审查自己的学习情况,毕竟看一遍,敲一遍,和自己归纳总结一遍有着很大的区别,在此期间我会参杂Java疯狂讲义(第四版)里面的内容. 前言: ...

随机推荐

  1. springboot获取配置文件中的内容

    代码: GrilApplication.java @SpringBootApplication public class GrilApplication { public static void ma ...

  2. 微信小程序------联动选择器

    picker 从底部弹起的滚动选择器,现支持五种选择器,通过mode来区分,分别是普通选择器,多列选择器,时间选择器,日期选择器,省市区选择器,默认是普通选择器. 先来看看效果图: 1:普通选择器 m ...

  3. 2016ACM/ICPC亚洲区沈阳站H - Guessing the Dice Roll HDU - 5955 ac自动机+概率dp+高斯消元

    http://acm.hdu.edu.cn/showproblem.php?pid=5955 题意:给你长度为l的n组数,每个数1-6,每次扔色子,问你每个串第一次被匹配的概率是多少 题解:先建成ac ...

  4. iptables详解(13):iptables动作总结之二

    概述 阅读这篇文章需要站在前文的基础上,如果你在阅读时遇到障碍,请参考之前的文章. 前文中,我们已经了解了如下动作 ACCEPT.DROP.REJECT.LOG 今天,我们来认识几个新动作,它们是: ...

  5. vue中element 的上传功能

    element 的上传功能 最近有个需求,需要在上传文件前,可以进行弹窗控制是否上传upload 看完文档后,感觉有两种思路可以实现 基于before-upload :上传文件之前的钩子,参数为上传的 ...

  6. Linux下第一次Node尝试

    由于需求所定,必须在服务器上使用nodejs,第一次使用过程记录下来. 首先是安装node,这里可以下载到各个版本的node:https://nodejs.org/download/ 我是进入rele ...

  7. 【javascript基础】 广告嵌套document.write的非iframe方式的延迟加载

    用ControlJS优化阿里妈妈广告http://ued.taobao.com/blog/2011/03/controljs-alimama/让document.write的广告无阻塞的加载http: ...

  8. 【css】25个漂亮的响应式布局的web设计【转】

    响应的web设计的做法是提高用户的浏览质量,并在不同设备上能够完美的浏览使用,就像大前端推出的D7主题.看看下面美丽的响应的网站布局,通过本文你会在以后的设计中找到响应的web设计的灵感. 1.Mar ...

  9. zabbix安装收获-WARNING: 'aclocal-1.14' is missing on your system

    zabbix server已经安装成功了,在server端也安装了一个agent,一切OK. 在另外一台pg节点上安装zabbix agent时,报错: WARNING: 'aclocal-1.14' ...

  10. 浅析Symbol

    不知道大家有没有留意ES6中的Symbol函数?在此之前,我对Symbol的认识知识这样的:  一.Symbol()和Symbol.for('str') Symbol()是独一无二的,你无法创建两个相 ...