复制本地文件到HDFS本地测试异常

项目中需要将本地文件拷贝到hdfs上，由于本人比较懒，于是使用擅长的Java程序通过Hadoop.FileSystem.CopyFromLocalFile方法来实现。在本地(Window 7 环境)本地模式下运行却遇到了下述异常：

An exception or error caused a run to abort: org.apache.hadoop.io.nativeio.NativeIO$Windows.createFileWithMode0(Ljava/lang/String;JJJI)Ljava/io/FileDescriptor;

java.lang.UnsatisfiedLinkError: org.apache.hadoop.io.nativeio.NativeIO$Windows.createFileWithMode0(Ljava/lang/String;JJJI)Ljava/io/FileDescriptor;

    at org.apache.hadoop.io.nativeio.NativeIO$Windows.createFileWithMode0(Native Method)

    at org.apache.hadoop.io.nativeio.NativeIO$Windows.createFileOutputStreamWithMode(NativeIO.java:559)

    at org.apache.hadoop.fs.RawLocalFileSystem$LocalFSFileOutputStream.<init>(RawLocalFileSystem.java:219)

    at org.apache.hadoop.fs.RawLocalFileSystem$LocalFSFileOutputStream.<init>(RawLocalFileSystem.java:209)

    at org.apache.hadoop.fs.RawLocalFileSystem.createOutputStreamWithMode(RawLocalFileSystem.java:307)

    at org.apache.hadoop.fs.RawLocalFileSystem.create(RawLocalFileSystem.java:295)

    at org.apache.hadoop.fs.RawLocalFileSystem.create(RawLocalFileSystem.java:328)

    at org.apache.hadoop.fs.ChecksumFileSystem$ChecksumFSOutputSummer.<init>(ChecksumFileSystem.java:388)

    at org.apache.hadoop.fs.ChecksumFileSystem.create(ChecksumFileSystem.java:451)

    at org.apache.hadoop.fs.ChecksumFileSystem.create(ChecksumFileSystem.java:430)

    at org.apache.hadoop.fs.FileSystem.create(FileSystem.java:920)

    at org.apache.hadoop.fs.FileSystem.create(FileSystem.java:901)

    at org.apache.hadoop.fs.FileSystem.create(FileSystem.java:798)

    at org.apache.hadoop.fs.FileUtil.copy(FileUtil.java:368)

    at org.apache.hadoop.fs.FileUtil.copy(FileUtil.java:341)

    at org.apache.hadoop.fs.FileUtil.copy(FileUtil.java:292)

    at org.apache.hadoop.fs.LocalFileSystem.copyFromLocalFile(LocalFileSystem.java:82)

    at org.apache.hadoop.fs.FileSystem.copyFromLocalFile(FileSystem.java:1882)

通过分析异常堆栈可知，

org.apache.hadoop.io.nativeio.NativeIO$Windows.createFileWithMode0方法发生了异常，createFileWithMode0方法的实现如下：

    /** Wrapper around CreateFile() with security descriptor on Windows */

    private static native FileDescriptor createFileWithMode0(String path,

        long desiredAccess, long shareMode, long creationDisposition, int mode)

        throws NativeIOException;

通过代码可知，这个方法是hadoop不支持的方法。那么为什么会调用这个方法，通过异常堆栈继续向上追踪，

是在 org.apache.hadoop.fs.RawLocalFileSystem$LocalFSFileOutputStream.<init> 过程调用了nativeio.NativeIO$Windows类，对应的方法如下：

  private LocalFSFileOutputStream(Path f, boolean append,

         FsPermission permission) throws IOException {

       File file = pathToFile(f);

       if (permission == null) {

         this.fos = new FileOutputStream(file, append);

       } else {

         if (Shell.WINDOWS && NativeIO.isAvailable()) {

           this.fos = NativeIO.Windows.createFileOutputStreamWithMode(file,

               append, permission.toShort());

         } else {

           this.fos = new FileOutputStream(file, append);

           boolean success = false;

           try {

             setPermission(f, permission);

             success = true;

           } finally {

             if (!success) {

               IOUtils.cleanup(LOG, this.fos);

             }

           }

         }

       }

     }

通过调用椎栈可知是上述代码第8行调用了NativeIO.Windows类。那么if判断应该是成立的，分析NativeIO.isAvailable方法代码如下：

   /**

    * Return true if the JNI-based native IO extensions are available.

    */

   public static boolean isAvailable() {

     return NativeCodeLoader.isNativeCodeLoaded() && nativeLoaded;

   }

isAvailable方法主要是调用NativeCodeLoader.isNativeCodeLoaded方法

  static {

     // Try to load native hadoop library and set fallback flag appropriately

     if(LOG.isDebugEnabled()) {

       LOG.debug("Trying to load the custom-built native-hadoop library...");

     }

     try {

       System.loadLibrary("hadoop");

       LOG.debug("Loaded the native-hadoop library");

       nativeCodeLoaded = true;

     } catch (Throwable t) {

       // Ignore failure to load

       if(LOG.isDebugEnabled()) {

         LOG.debug("Failed to load native-hadoop with error: " + t);

         LOG.debug("java.library.path=" +

             System.getProperty("java.library.path"));

       }

     }

     if (!nativeCodeLoaded) {

       LOG.warn("Unable to load native-hadoop library for your platform... " +

                "using builtin-java classes where applicable");

     }

   }

   /**

    * Check if native-hadoop code is loaded for this platform.

    *

    * @return <code>true</code> if native-hadoop is loaded,

    *         else <code>false</code>

    */

   public static boolean isNativeCodeLoaded() {

     return nativeCodeLoaded;

   }

通过可以看到，isNativeCodeLoaded方法就是返回一个属性值，那么问题出现在什么地方呢？

经过分析NativeCodeLoaded类的静态构造函数，有一个“System.loadLibrary("hadoop")”方法。是不是这个方法导致的呢？通过在其他同事环境上调试，System.loadLibrary("hadoop") 会异常，从而运行catch部分，但是本人电脑却不会异常，直接继续运行。那么System.loadLibrary方法是什么用途呢，通过分析源码知道，这个方法是加载本地系统和用户的环境变量的。进而分析是因为本人在C:\\Windows\System32目录下有hadoop.dll文件或环境变量Path中配置了%Hadoop_Home%/bin目录而导致的。

简而言之，是因为配置的系统环境变量Path的任意目录下存在hadoop.dll文件，从而被认为这是一个hadoop集群环境，但是hadoop集群又不支持window环境而产生的异常。处理方法也很简单，检查系统环境变量Path下的每一个目录，确保没有hadoop.dll文件即可。

如果是删除系统环境变量Path的某一个目录，需要重启Intellij Idea后ClassLoader类中的usr_paths或sys_paths才会生效。

复制本地文件到HDFS本地测试异常的更多相关文章

5、创建RDD（集合、本地文件、HDFS文件）
一.创建RDD 1.创建RDD 进行Spark核心编程时,首先要做的第一件事,就是创建一个初始的RDD.该RDD中,通常就代表和包含了Spark应用程序的输入源数据.然后在创建了初始的RDD之后,才可 ...
02、创建RDD（集合、本地文件、HDFS文件）
Spark Core提供了三种创建RDD的方式,包括:使用程序中的集合创建RDD:使用本地文件创建RDD:使用HDFS文件创建RDD. 1.并行化集合如果要通过并行化集合来创建RDD,需要针对程序中 ...
上传本地文件到HDFS
源代码: import java.io.IOException; import org.apache.hadoop.conf.Configuration; import org.apache.hado ...
【HDFS API编程】从本地拷贝文件，从本地拷贝大文件，拷贝HDFS文件到本地
接着之前继续API操作的学习 CopyFromLocalFile: 顾名思义,从本地文件拷贝 /** * 使用Java API操作HDFS文件系统 * 关键点: * 1)create Configur ...
spark读取本地文件
/** * Read a text file from HDFS, a local file system (available on all nodes), or any * Hadoop-supp ...
超实用，你get了吗？再也不怕本地文件更新到环境用Linux命令重启服务器了。。。
来公司这么久,写过不少代码,可是一碰见关于Linux命令操作的马上绕过,每次都是嚷嚷同事过来帮我替换文件,重启服务器,一直害怕接触命令的我一次一次不嫌麻烦,哈哈.有没有醉了?其实我一直都知道操作不难, ...
两种方法上传本地文件到github
https://www.jianshu.com/p/c70ca3a02087 自从使用github以来,一直都是在github网站在线上传文件到仓库中,但是有时因为网络或者电脑的原因上传失败.最重要的 ...
两种方法上传本地文件到github(转)
自从使用github以来,一直都是在github网站在线上传文件到仓库中,但是有时因为网络或者电脑的原因上传失败.最重要的原因是我习惯本地编辑,完成以后再一起上传github.看过了几个教程,总结出最 ...
Git安装及密钥的生成并上传本地文件到GitHub上
之前用的GitHub,不太熟练,一直在上传的过程中遇到了一些问题,看了网上诸多教程,总觉得很乱,特参考一些资料,总结了一篇完整的操作步骤,从下载安装到上传文件,亲测有效 1.下载Git软件:https ...

随机推荐

整理一下自己用到的SVN几个命令
第一步 svn co 代码分支(http://yyyyyyyyyyyyyyyy) 将开发给的代码分支地址中的代码拉到测试机中第二步 cd /目录进入需要拉代码的目录然后 ll 查看目录下的 ...
The C Programming Language Exercise
1-9 : Write a program to copy its input to its output, replacing each string of one or more blanks b ...
块状元素(div)与内联元素（span）
<pre class="html" name="code"><html xmlns="http://www.w3.org/1999/ ...
IAR调节字体大小
在主面板上点击tools->Options,然后点开Editor,选择下面的Colors and Fonts选项,最后选右上方的Font,选择要设置的字体就OK了.
Foundation ----->NSNumber
/*--------------------NSNumber--------------------*/ //包装基本数据类型 //1.创建number对象 //12 ...
XP局域网内专用消息队列
网上能找到DELPHI消息队列的方法,在XP下试了总是不成功,后来在2003上试就行了,对比发现消息队列属性->安全 2003中多了个用户ANONYMOUS_LOGON. 然后在XP下消息队列属 ...
Spark学习笔记之SparkRDD
Spark学习笔记之SparkRDD 一. 基本概念 RDD(resilient distributed datasets)弹性分布式数据集. 来自于两方面 ① 内存集合和外部存储系统 ② ...
使用github参与开源项目
github上有很多非常优秀的开源项目,作为开源项目的受益者,你否想过为开源项目贡献自己的代码?
kendo ui 富文本编辑控件 Editor 实现本地上传图片，并显示
富文本编辑的组件有很多,大名鼎鼎的KENDO UI中自然也有,但是默认功能中,只能包含网络图片, 而如果要实现本地上传图片,KENDO UI也提供了相应的功能,但必须实现KENDO规定的多个接口, 而 ...
C# 串口操作系列(3) -- 协议篇，二进制协议数据解析
原文地址:http://blog.csdn.net/wuyazhe/article/details/5627253 我们的串口程序,除了通用的,进行串口监听收发的简单工具,大多都和下位机有关,这就需要 ...

复制本地文件到HDFS本地测试异常

复制本地文件到HDFS本地测试异常的更多相关文章

随机推荐

热门专题