hdfs基本操作

-涂涂- 2024-10-22 21:39:30 原文

hdfs基本操作

1、查询命令

　　hadoop dfs -ls / 查询/目录下的所有文件和文件夹

　　hadoop dfs -ls -R 以递归的方式查询/目录下的所有文件

2、创建文件夹

　　hadoop dfs -mkdir /test 创建test文件夹

3、创建新的空文件

　　hadoop dfs -touchz /aa.txt 在/目录下创建一个空文件aa.txt

4、增加文件

　　hadoop dfs -put aa.txt /test 将当前目录下的aa.txt文件复制到/test目录下（把-put换成-copyFromLocal效果一样-moveFromLocal会移除本地文件）

5、查看文件内容

　　hadoop dfs -cat /test/aa.txt 查看/test目录下文件aa.txt的内容（将-cat 换成-text效果一样）

6、复制文件

　　hadoop dfs -copyToLocal /test/aa.txt . 将/test/aa.txt文件复制到当前目录（.是指当前目录，也可指定其他的目录）

7、删除文件或文件夹

　　hadoop dfs -rm -r /test/aa.txt 删除/test/aa.txt文件（/test/aa.txt可以替换成文件夹就是删除文件夹）

8、重命名文件

　　hadoop dfs -mv /aa.txt /bb.txt 将/aa.txt文件重命名为/bb.txt

9、将源目录中的所有文件排序合并到一个本地文件

　　hadoop dfs -getmerge / local-file 将/目录下的所有文件合并到本地文件local-file中

hdfsWeb查看文件

1、通过命令行：

　　hadoop dfs -ls /mydir/testdir

2、通过web界面

　　1）、概述：

　　　　在本地的浏览器输入namenode节点服务器的ip或域名+端口（例如：我namenode几点机器ip是10.9.1.101:9870），就可以看到hdfs集群的概述：

　　2）、查看文件：

　　　　点击导航栏的Utilities按钮，选择查看文件或者日志，选择查看文件之后，然后再输入栏输入文件的路径就可以查看文件了。

　　3）、查看数据节点信息：

　　　　点击导航栏的Datanodes按钮，然后出现以下页面：

　　　　此时假如点击查看具体的数据节点的时候会报错，因为你windows操作系统不能识别node101~node103，此时需要配置下widows的hosts文件，配置完了就好了。

　　　　hdfs的web操作就说这么多了，剩下的大家有兴趣可以去慢慢的看了

注：hadoop 为用户名如果你的名字不是这个就相应的修改下（如：hadoop dfs -cat /test/aa.txt ----> myname dfs -cat /test/aa.txt ）。

hdfs基本操作的更多相关文章

hdfs基本操作-python接口
安装hdfs包 pip install hdfs 查看hdfs目录 [root@hadoop hadoop]# hdfs dfs -ls -R / drwxr-xr-x - root supergro ...
HDFS基本操作的API
一.从hdfs下载文件到windows本地: package com.css.hdfs01; import java.io.IOException; import java.net.URI; impo ...
Hadoop（二）Hdfs基本操作
HDFS HDFS由大量服务器组成存储集群,将数据进行分片与副本,实现高容错. 而分片最小的单位就是块.默认块的大小是64M. HDFS Cli操作官网https://hadoop.apache.o ...
hdfs shell的基本操作以及hdfsWeb查看文件
在安装好hadoop集群并成功的启动了hdfs之后,我们就可以利用hdfs对文件进行操作了,一下是对文件的一些基本操作 hdfs基本操作 1.查询命令 hadoop dfs -ls / 查询/目录 ...
HDFS基本原理及数据存取实战
---------------------------------------------------------------------------------------------------- ...
HDFS详解
HDFS详解大纲 Hadoop HDFS 分布式文件系统DFS简介 HDFS的系统组成介绍 HDFS的组成部分详解副本存放策略及路由规则命令行接口 Java接口客户端与HDFS的数据流讲解目标 ...
HDFS基础1
一.HDFS入门二.HDFS基本操作 1.shell命令行客户端 Hadoop提供了文件系统的shell命令行客户端,使用方法如下: Hadoop fs <args>(参数哪一个文件系统 ...
HDFS的介绍
设计思想分而治之:将大文件.大批量文件,分布式存放在大量服务器上,以便于采取分而治之的方式对海量数据进行运算分析: 在大数据系统中作用:为各类分布式运算框架(如:mapreduce,spark,te ...
Hadoop之HDFS（一）HDFS入门及基本Shell命令操作
1 ． HDFS 基本概念 1.1 HDFS 介绍 HDFS 是 Hadoop Distribute File System 的简称,意为:Hadoop 分布式文件系统.是 Hadoop 核心组件之 ...

随机推荐

Directory 中user Var 如何添加到通道变量中？
FS默认的配置,ACL 是拒绝的,只能通过 Digest 的方式进行认证,一旦认证成功之后,directory 中的 var 就能在通道中通过${} 的方式获取到. 如果ACL 认证通过 ,就直接走 ...
Vue-cli 搭建web服务介绍
Node.js 之 npm 包管理 - Node.js 官网地址:点我前往官网 - Node.js 中文镜像官网: 点我前往```` Node.js 是一个基于 Chrome V8 引擎的 JavaS ...
使用JUnit进行类的测试（一）
首先是测试的一些常用标注: @Test:执行测试的方法 @Before & @After : 在测试的方法 “前” 或者 “后” 被唤醒 -Initialization -Release r ...
什么是orm思想？
什么是orm思想? 1.hibernate使用orm思想对数据库进行crud操作 2.在web阶段学习javabean更正确的叫法是:实体类 3.orm: object relational ...
jQuery获取地址栏中的链接参数
http://caibaojian.com/177.html 问题描述今天做一个主题,有一个需求是根据不同的页面来做,虽然php也可以做到,不过考虑到自己的特效代码都是在jQuery上完成,想着能否 ...
LeetCode（91）：解码方法
Medium! 题目描述: 一条包含字母 A-Z 的消息通过以下方式进行了编码: 'A' -> 1 'B' -> 2 ... 'Z' -> 26 给定一个只包含数字的非空字符串,请计 ...
(批量更新)对多个符合条件的id做更新操作
需求描述:把checkbox勾选的对应id的记录的标志位置1或0,这个其实不难的,不过我自己做的话,肯定是多次访问数据库做更新,看了老大的代码,发现差距不是一般的大,老大把sql灵活运用,结果一次访问 ...
SQLAchemy基础知识
一.什么是SQLAchemy? SQLAlchemy是Python编程语言下的一款ORM框架,该框架建立在数据库API之上,使用关系对象映射进行数据库操作,简言之便是:将对象转换成SQL,然后使用数据 ...
JumpServer里的sftp功能报错说明
JumpServer里sftp默认的家目录是/tmp下修改默认家目录: vim /usr/local/coco/coco/sftp.py class SFTPServer(paramiko.SFTP ...
linux：安装并使用activeMQ
1.下载安装包:curl -O https://archive.apache.org/dist/activemq/5.14.0/apache-activemq-5.14.0-bin.tar.gz 2. ...