spark wordcount程序

spark wordcount程序 IllegalAccessError错误

这个错误是权限错误，错误的引用方法，比如方法中调用private,protect方法。

当然大家知道wordcount业务很简单，都是调用依赖的方法，最后在一篇博客讲了错误:spark 2.2 读取 Hadoop3.0 数据异常

我试了下，解决了，我没有像他依赖那么多。

Exception in thread "main" java.lang.IllegalAccessError: class org.apache.hadoop.hdfs.web.HftpFileSystem cannot access its superinterface org.apache.hadoop.hdfs.web.TokenAspect$TokenManagementDelegator

        at java.lang.ClassLoader.defineClass1(Native Method)

        at java.lang.ClassLoader.defineClass(ClassLoader.java:763)

        at java.security.SecureClassLoader.defineClass(SecureClassLoader.java:142)

        at java.net.URLClassLoader.defineClass(URLClassLoader.java:467)

        at java.net.URLClassLoader.access$100(URLClassLoader.java:73)

        at java.net.URLClassLoader$1.run(URLClassLoader.java:368)

        at java.net.URLClassLoader$1.run(URLClassLoader.java:362)

        at java.security.AccessController.doPrivileged(Native Method)

        at java.net.URLClassLoader.findClass(URLClassLoader.java:361)

        at java.lang.ClassLoader.loadClass(ClassLoader.java:424)

        at java.lang.ClassLoader.loadClass(ClassLoader.java:357)

        at java.lang.Class.forName0(Native Method)

        at java.lang.Class.forName(Class.java:348)

        at java.util.ServiceLoader$LazyIterator.nextService(ServiceLoader.java:370)

        at java.util.ServiceLoader$LazyIterator.next(ServiceLoader.java:404)

        at java.util.ServiceLoader$1.next(ServiceLoader.java:480)

        at org.apache.hadoop.fs.FileSystem.loadFileSystems(FileSystem.java:3202)

        at org.apache.hadoop.fs.FileSystem.getFileSystemClass(FileSystem.java:3247)

        at org.apache.hadoop.fs.FileSystem.createFileSystem(FileSystem.java:3286)

        at org.apache.hadoop.fs.FileSystem.access$200(FileSystem.java:123)

        at org.apache.hadoop.fs.FileSystem$Cache.getInternal(FileSystem.java:3337)

        at org.apache.hadoop.fs.FileSystem$Cache.get(FileSystem.java:3305)

        at org.apache.hadoop.fs.FileSystem.get(FileSystem.java:476)

        at org.apache.spark.util.Utils$.getHadoopFileSystem(Utils.scala:1857)

        at org.apache.spark.scheduler.EventLoggingListener.<init>(EventLoggingListener.scala:68)

        at org.apache.spark.SparkContext.<init>(SparkContext.scala:532)

问题分析

我使用cdh安装spark的，spark版本是2.4.0，hadoop是hadoop3.0.0。我特地看下idea的extern依赖包，hadoop的依赖包是2.6.X。

这样的看存在使用的spark包依赖hdoop包版本与生产环境上的hadoop版本不一致。

解决方式就是spark的依赖hadoop，我屏蔽掉，重新手动导入hadoop包

解决方式

    <properties>

        <hbase.version>2.0.0</hbase.version>

        <spark.version>2.4.0</spark.version>

        <scala.version>2.11.12</scala.version>

        <hadoop.version>3.0.0</hadoop.version>

    </properties>

    <dependencies>

<!--        <dependency>

            <groupId>org.apache.spark</groupId>

            <artifactId>spark-core_2.12</artifactId>

            <version>${spark.version}</version>

            <scope>provided</scope>

        </dependency>-->

<!--        解决IllegalAccessError-->

        <dependency>

            <groupId>org.apache.hadoop</groupId>

            <artifactId>hadoop-client</artifactId>

            <version>${hadoop.version}</version>

        </dependency>

        <dependency>

            <groupId>org.apache.spark</groupId>

            <artifactId>spark-core_2.11</artifactId>

            <version>${spark.version}</version>

            <exclusions>

                <exclusion>

                    <artifactId>hadoop-client</artifactId>

                    <groupId>org.apache.hadoop</groupId>

                </exclusion>

            </exclusions>

        </dependency>

</dependencies>

附录 wordcount程序

package com.learn.hadoop.spark.wordcount;

import org.apache.spark.SparkConf;

import org.apache.spark.api.java.JavaPairRDD;

import org.apache.spark.api.java.JavaRDD;

import org.apache.spark.api.java.JavaSparkContext;

import org.apache.spark.api.java.function.FlatMapFunction;

import org.apache.spark.api.java.function.Function2;

import org.apache.spark.api.java.function.PairFunction;

import org.apache.spark.api.java.function.VoidFunction;

import scala.Tuple2;

import java.util.Arrays;

import java.util.Iterator;

public class WordCount {

    public static void main(String[] args) {

        if(args ==null ||args.length<1)

        {

            System.err.println("please input paths");

            System.exit(1);

        }

        String outfile =args[0];

        SparkConf sparkConf =new SparkConf().setMaster("local").setAppName("wordCount");

        JavaSparkContext sc =new JavaSparkContext(sparkConf);

        String inputFile="README.MD";

        JavaRDD<String> input =sc.textFile(inputFile);

        JavaRDD<String> lines =input.flatMap(new FlatMapFunction<String, String>() {

            @Override

            public Iterator<String> call(String s) throws Exception {

                return Arrays.asList(s.split(" ")).iterator();

                //return null;

            }

        });

        //paris

        JavaPairRDD<String,Integer> paris = lines.mapToPair(new PairFunction<String, String, Integer>() {

            @Override

            public Tuple2<String, Integer> call(String s) throws Exception {

                return new Tuple2<String,Integer>(s,1);

            }

        });

        //redues

        JavaPairRDD<String,Integer> counts=paris.reduceByKey(new Function2<Integer, Integer, Integer>() {

            @Override

            public Integer call(Integer integer, Integer integer2) throws Exception {

                return integer+integer2;

            }

        });

        //output

        counts.foreach(new VoidFunction<Tuple2<String, Integer>>() {

            @Override

            public void call(Tuple2<String, Integer> stringIntegerTuple2) throws Exception {

                System.out.println(stringIntegerTuple2);

            }

        });

        counts.saveAsTextFile(outfile);

        sc.stop();

    }

}

spark wordcount程序的更多相关文章

大数据笔记（二十八）——执行Spark任务、开发Spark WordCount程序
一.执行Spark任务: 客户端 1.Spark Submit工具:提交Spark的任务(jar文件) (*)spark提供的用于提交Spark任务工具 (*)example:/root/traini ...
idea配置scala编写spark wordcount程序
1.创建scala maven项目选择骨架的时候为org.scala-tools.archetypes:scala-aechetype-simple 1.2 2.导入包,进入spark官网Docum ...
[转] 用SBT编译Spark的WordCount程序
问题导读: 1.什么是sbt? 2.sbt项目环境如何建立? 3.如何使用sbt编译打包scala? [sbt介绍 sbt是一个代码编译工具,是scala界的mvn,可以编译scala,java等,需 ...
用SBT编译Spark的WordCount程序
问题导读: 1.什么是sbt? 2.sbt项目环境如何建立? 3.如何使用sbt编译打包scala? sbt介绍 sbt是一个代码编译工具,是scala界的mvn,可以编译scala,java等,需要 ...
编写Spark的WordCount程序并提交到集群运行[含scala和java两个版本]
编写Spark的WordCount程序并提交到集群运行[含scala和java两个版本] 1. 开发环境 Jdk 1.7.0_72 Maven 3.2.1 Scala 2.10.6 Spark 1.6 ...
将java开发的wordcount程序提交到spark集群上运行
今天来分享下将java开发的wordcount程序提交到spark集群上运行的步骤. 第一个步骤之前,先上传文本文件,spark.txt,然用命令hadoop fs -put spark.txt /s ...
spark学习11（Wordcount程序-本地测试）
wordcount程序文件wordcount.txt hello wujiadong hello spark hello hadoop hello python 程序示例 package wujia ...
大话Spark(3)-一图深入理解WordCount程序在Spark中的执行过程
本文以WordCount为例, 画图说明spark程序的执行过程 WordCount就是统计一段数据中每个单词出现的次数, 例如hello spark hello you 这段文本中hello出现2次 ...
55、Spark Streaming:updateStateByKey以及基于缓存的实时wordcount程序
一.updateStateByKey 1.概述 SparkStreaming 7*24 小时不间断的运行,有时需要管理一些状态,比如wordCount,每个batch的数据不是独立的而是需要累加的,这 ...

随机推荐

ffmpeg 音频常用命令
ffmpeg的使用方式: ffmpeg [options] [[infile options] -i infile]... {[outfile options] outfile}... Stream ...
springmvc、 springboot 项目全局异常处理
异常在项目中那是不可避免的,通常情况下,我们需要对全局异常进行处理,下面介绍两种比较常用的情况. 准备工作: 在捕获到异常的时候,我们通常需要返回给前端错误码,错误信息等,所以我们需要手动封装一个js ...
《深入浅出WPF》学习总结之Binding
一.前言友好的图形用户界面(Graphics User Interface ,GUI)的流行也就是近十来年的事情,之前应用程序与用户的交互是通过控制台界面(Console User Interfac ...
IntelliJ IDEA 2017.3尚硅谷-----设置项目文件编码
这也可以 R暂时显示 C转换
IIS 无法读取配置节"system.web.extensions",因为它缺少节声明
IIS 无法读取配置节"system.web.extensions",因为它缺少节声明先安装ASP.NET 4.0 然后: 今天在本地安装iis,搭建网站,应用程序的时候报错下 ...
Type Java类型
参考:https://blog.csdn.net/a327369238/article/details/52621043 Type —— Java类型 Type是一个空接口,所有类型的公共接口(父接口 ...
django项目日志
接口中,写一条日志: 日志工具文件如下:
Refusing to install package with name "webpack" under a package
最近学习webpack 知识时下载依赖结果报了这个错查阅资料后发现是这个name 不能使用所需要安装包的名字! 换为其他之后再次操作命令就没问题了
ES5 寄生式继承
3 寄生式继承组合继承存在调用两次父类构造的问题原型继承存在不能实例化对象不能传参的问题组合继承和原型继承都存在子类原有原型属性被覆盖的问题因此推荐使用寄生式继承 /* 寄生式继承: 1 解决 ...
Go_栈
1. 栈的介绍 2. 栈的应用 3. 栈入门 package main import ( "fmt" "errors" ) //使用数组来模拟一个栈的使用 ty ...