HDFS的Java客户端编写

总结：之前在教材上看hdfs的Java客户端编写，只有关键代码，呵呵……。闲话不说，上正文。

1. Hadoop 的Java客户端编写建议在linux系统上开发

2. 可以使用eclipse,idea 等IDE工具，目前比较流行的是idea

3. 新建项目之后需要添加很多jar包，win，linux下添加jar方式略有不同

　　 4. 使用代码会出现文件格式不认识，权限等问题。

具体：

1.首先测试从hdfs中下载文件:

下载文件的代码:(将hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz文件下载到本地/opt/download/doload.tgz)

package cn.qlq.hdfs;

import java.io.FileOutputStream;

import java.io.IOException;

import org.apache.commons.compress.utils.IOUtils;

import org.apache.hadoop.conf.Configuration;

import org.apache.hadoop.fs.FSDataInputStream;

import org.apache.hadoop.fs.FileSystem;

import org.apache.hadoop.fs.Path;

public class HdfsUtil {

    public static void main(String a[]) throws IOException {

        //to upload a file

        Configuration conf = new Configuration();

        FileSystem fs = FileSystem.get(conf);

        Path path = new Path("hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz");

        FSDataInputStream input = fs.open(path);

        FileOutputStream output = new FileOutputStream("/opt/download/doload.tgz");

        IOUtils.copy(input, output);

    }

}

直接运行报错:

　　原因是程序不认识 hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz 这样的目录

log4j:WARN No appenders could be found for logger (org.apache.hadoop.metrics2.lib.MutableMetricsFactory).

log4j:WARN Please initialize the log4j system properly.

log4j:WARN See http://logging.apache.org/log4j/1.2/faq.html#noconfig for more info.

Exception in thread "main" java.lang.IllegalArgumentException: Wrong FS: hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz, expected: file:///

    at org.apache.hadoop.fs.FileSystem.checkPath(FileSystem.java:643)

    at org.apache.hadoop.fs.RawLocalFileSystem.pathToFile(RawLocalFileSystem.java:79)

    at org.apache.hadoop.fs.RawLocalFileSystem.deprecatedGetFileStatus(RawLocalFileSystem.java:506)

    at org.apache.hadoop.fs.RawLocalFileSystem.getFileLinkStatusInternal(RawLocalFileSystem.java:724)

    at org.apache.hadoop.fs.RawLocalFileSystem.getFileStatus(RawLocalFileSystem.java:501)

    at org.apache.hadoop.fs.FilterFileSystem.getFileStatus(FilterFileSystem.java:397)

    at org.apache.hadoop.fs.ChecksumFileSystem$ChecksumFSInputChecker.<init>(ChecksumFileSystem.java:137)

    at org.apache.hadoop.fs.ChecksumFileSystem.open(ChecksumFileSystem.java:339)

    at org.apache.hadoop.fs.FileSystem.open(FileSystem.java:764)

    at cn.qlq.hdfs.HdfsUtil.main(HdfsUtil.java:21)

解决办法:

第一种:　将hadoop安装目录下的etc目录中的core-site.xml拷贝到eclipse的src目录下。这样就不会报错

运行结果:

[root@localhost download]# ll

total 140224

-rw-r--r--. 1 root root 143588167 Apr 20 05:55 doload.tgz

[root@localhost download]# pwd

/opt/download

[root@localhost download]# ll

total 140224

-rw-r--r--. 1 root root 143588167 Apr 20 05:55 doload.tgz

第二种:直接在程序中修改

　　我们先查看hdfs-site.xml中的内容:

<?xml version="1.0" encoding="UTF-8"?>

<?xml-stylesheet type="text/xsl" href="configuration.xsl"?>

<configuration>

<property>

<name>fs.defaultFS</name>

<value>hdfs://localhost:9000</value>

</property>

<property>

<name>hadoop.tmp.dir</name>

<value>/opt/hadoop/hadoop-2.4.1/data/</value>

</property>

</configuration>

代码改为:

    public static void main(String a[]) throws IOException {

        //to upload a filed

        Configuration conf = new Configuration();

        //set hdfs root dir

        conf.set("fs.defaultFS", "hdfs://localhost:9000");

        FileSystem fs = FileSystem.get(conf);

        Path path = new Path("hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz");

        FSDataInputStream input = fs.open(path);

        FileOutputStream output = new FileOutputStream("/opt/download/doload.tgz");

        IOUtils.copy(input, output);

    }

2.下面代码演示了hdfs的基本操作:

package cn.qlq.hdfs;

import java.io.FileInputStream;

import java.io.FileNotFoundException;

import java.io.FileOutputStream;

import java.io.IOException;

import java.net.URI;

import java.net.URISyntaxException;

import org.apache.commons.compress.utils.IOUtils;

import org.apache.hadoop.conf.Configuration;

import org.apache.hadoop.fs.FSDataInputStream;

import org.apache.hadoop.fs.FSDataOutputStream;

import org.apache.hadoop.fs.FileStatus;

import org.apache.hadoop.fs.FileSystem;

import org.apache.hadoop.fs.LocatedFileStatus;

import org.apache.hadoop.fs.Path;

import org.apache.hadoop.fs.RemoteIterator;

import org.junit.Before;

import org.junit.Test;

public class HdfsUtil {

    private FileSystem fs = null;

    @Before

    public void befor() throws IOException, InterruptedException, URISyntaxException{

        //读取classpath下的xxx-site.xml 配置文件，并解析其内容，封装到conf对象中

        Configuration conf = new Configuration();

        //也可以在代码中对conf中的配置信息进行手动设置，会覆盖掉配置文件中的读取的值

        conf.set("fs.defaultFS", "hdfs://localhost:9000/");

        //根据配置信息，去获取一个具体文件系统的客户端操作实例对象

        fs = FileSystem.get(new URI("hdfs://localhost:9000/"),conf,"root");

    }

    /**

     * 上传文件，比较底层的写法

     *

     * @throws Exception

     */

    @Test

    public void upload() throws Exception {

        Path dst = new Path("hdfs://localhost:9000/aa/qingshu.txt");

        FSDataOutputStream os = fs.create(dst);

        FileInputStream is = new FileInputStream("/opt/download/haha.txt");

        IOUtils.copy(is, os);

    }

    /**

     * 上传文件，封装好的写法

     * @throws Exception

     * @throws IOException

     */

    @Test

    public void upload2() throws Exception, IOException{

        fs.copyFromLocalFile(new Path("/opt/download/haha.txt"), new Path("hdfs://localhost:9000/aa/qingshu2.txt"));

    }

    /**

     * download file

     * @throws IOException

     */

    @Test

    public  void download() throws IOException {

        Path path = new Path("hdfs://localhost:9000/jdk-7u65-linux-i586.tar.gz");

        FSDataInputStream input = fs.open(path);

        FileOutputStream output = new FileOutputStream("/opt/download/doload.tgz");

        IOUtils.copy(input, output);

    }

    /**

     * 下载文件

     * @throws Exception

     * @throws IllegalArgumentException

     */

    @Test

    public void download2() throws Exception {

        fs.copyToLocalFile(new Path("hdfs://localhost:9000/aa/qingshu2.txt"), new Path("/opt/download/haha2.txt"));

    }

    /**

     * 查看文件信息

     * @throws IOException

     * @throws IllegalArgumentException

     * @throws FileNotFoundException

     *

     */

    @Test

    public void listFiles() throws FileNotFoundException, IllegalArgumentException, IOException {

        // listFiles列出的是文件信息，而且提供递归遍历

        RemoteIterator<LocatedFileStatus> files = fs.listFiles(new Path("/"), true);

        while(files.hasNext()){

            LocatedFileStatus file = files.next();

            Path filePath = file.getPath();

            String fileName = filePath.getName();

            System.out.println(fileName);

        }

        System.out.println("---------------------------------");

        //listStatus 可以列出文件和文件夹的信息，但是不提供自带的递归遍历

        FileStatus[] listStatus = fs.listStatus(new Path("/"));

        for(FileStatus status: listStatus){

            String name = status.getPath().getName();

            System.out.println(name + (status.isDirectory()?" is dir":" is file"));

        }

    }

    /**

     * 创建文件夹

     * @throws Exception

     * @throws IllegalArgumentException

     */

    @Test

    public void mkdir() throws IllegalArgumentException, Exception {

        fs.mkdirs(new Path("/aaa/bbb/ccc"));

    }

    /**

     * 删除文件或文件夹

     * @throws IOException

     * @throws IllegalArgumentException

     */

    @Test

    public void rm() throws IllegalArgumentException, IOException {

        fs.delete(new Path("/aa"), true);

    }

}

HDFS的Java客户端编写的更多相关文章

2 weekend110的HDFS的JAVA客户端编写 + filesystem设计思想总结
HDFS的JAVA客户端编写现在,我们来玩玩,在linux系统里,玩eclipse 或者, 即,更改图标,成功这个,别慌.重新换个版本就好,有错误出错是好事. http://www.eclips ...
一次失败的尝试hdfs的java客户端编写（在linux下使用eclipse）
一次失败的尝试hdfs的java客户端编写(在linux下使用eclipse) 给centOS安装图形界面 GNOME桌面环境 https://blog.csdn.net/wh211212/artic ...
【Hadoop】HDFS的java客户端编写
项目使用了Maven Project 快速进行HDFS 客户端程序测试客户端操作系统:win10 64位 JDK: 1.7.0_79 开发工具 :Eclipse Luna pom.xml < ...
一脸懵逼学习hadoop之HDFS的java客户端编写
1:eclipse创建一个项目,然后导入对应的jar包: 鼠标右击项目,点击properties或者alt+enter快捷键--->java build path--->libraries ...
day03-hdfs的客户端操作\hdfs的java客户端编程
5.hdfs的客户端操作客户端的理解 hdfs的客户端有多种形式: 1.网页形式 2.命令行形式 3.客户端在哪里运行,没有约束,只要运行客户端的机器能够跟hdfs集群联网文件的切块大小和存储的副 ...
hdfs shell命令及java客户端编写
一. hdfs shell命令可以通过hadoop fs 查看所有的shell命令及其用法. 传文件到hdfs: hadoop fs -put /home/koushengrui/Downloads ...
HDFS的Java客户端操作代码(HDFS的查看、创建)
1.HDFS的put上传文件操作的java代码: package Hdfs; import java.io.FileInputStream; import java.io.FileNotFoundEx ...
HDFS的java客户端操作代码(Windows上面打jar包，提交至linux运行)
1.通过java.net.URL实现屏幕显示demo1文件的内容 package Hdfs; import java.io.InputStream; import java.net.URL; impo ...
HDFS的Java客户端操作代码(HDFS删除文件或目录)
1.HDFS删除文件或目录 package Hdfs; import java.io.IOException; import java.net.URI; import org.apache.hadoo ...

随机推荐

python底层原理
有同学问到了一个问题,python中存储变量是通过内存地址来存储,那么python又是如何去判断内存中的地址是什么数据类型的呢.经过查找,找到这篇文章: 原博客地址:http://www.cnblog ...
Anaconda介绍、安装及使用教程
https://www.jianshu.com/p/62f155eb6ac5 Anaconda介绍.安装及使用教程 Python是一种面向对象的解释型计算机程序设计语言,其使用,具有跨平台的特点,可以 ...
LOJ 6270
最近(一直)有点(很)蠢按照区间大小排序做区间包含多少区间的话只用考虑左端点比当前左端点小的和右端点比当前右端点大的,因为不可能同时满足关于K,就在做到K的时候减一下就好了,一直傻逼在这了 # ...
JS对象3
1.BOM对象 window对象所有浏览器都支持window对象概念上讲:一个html文档对应一个window对象功能上讲:控制浏览器窗口的使用上讲:window对象不需要创建对象,直接使用即 ...
Vue（二十六）父子组件通信
今天写了一个分页公共组件,就出现了父子组件通信的问题,今天来总结下我遇到的父子组件通信问题一.子组件调取父组件的数据或方法 (1)props 想要把父组件的值,传到子组件中,使用props 比如你在 ...
AJAX_违反了同源策略_就是"跨域"——jsonp 和 cors
https 协议默认端口号 443 http 协议默认端口号 80 同源策略由网景公司提出的——浏览器的为了浏览器安全而生同源策略: 协议.域名.端口号必须完全一致违 ...
[LeetCode] Largest Triangle Area 最大的三角区域
You have a list of points in the plane. Return the area of the largest triangle that can be formed b ...
写给踏入IT行业的自己
在IT工程师和培训机构多如牛毛的时代,拜师学艺并不难.但自学编程对于毫无基础的同学来说却可能是个问题,相信有过类似经历的朋友都有一把辛酸泪和一肚不吐不快的体会.让我们从一个故事说起… 故事某君在一个 ...
python3 文件读写操作中的文件指针seek()使用
python中可以使用seek()移动文件指针到指定位置,然后读/写.通常配合 r+ .w+.a+ 模式,在此三种模式下,seek指针移动只能从头开始移动,即seek(x,0) . 模式默认写方式 ...
js 用touch事件实现简单tap
function _tap(dom,callBack){ var startTime=0; var delayTime=200; var isMove=false; dom.addEventListe ...

HDFS的Java客户端编写

1.首先测试从hdfs中下载文件:

2.下面代码演示了hdfs的基本操作:

HDFS的Java客户端编写的更多相关文章

随机推荐

热门专题