最近想来,大数据相关技术与传统型数据库技术很多都是相互融合.互相借鉴的.传统型数据库强势在于其久经考验的SQL优化器经验,弱势在于分布式领域的高可用性.容错性.扩展性等,假以时日,让其经过一定的改造,比如引入Paxos.raft等,强化自己在分布式领域的能力,相信一定会在大数据系统中占有一席之地.相反,大数据相关技术优势在于其天生的扩展性.可用性.容错性等,但其SQL优化器经验却基本全部来自于传统型数据库,当然,针对列式存储大数据SQL优化器会有一定的优化策略. 本文主要介绍SparkSQL的优