HDFS基础1
一、HDFS入门
二、HDFS基本操作
1、shell命令行客户端
Hadoop提供了文件系统的shell命令行客户端,使用方法如下:
Hadoop fs <args>(参数哪一个文件系统和什么样的操作)
文件系统shell包括与Hadoop分布式文件系统(HDFS)以及Hadoop支持的其他文件系统(如本地FS, HFTP FS, S3 FS等)直接交互的各种类似shell的命令。所有FS shell命令都将路径URI作为参数
URI格式为scheme://suthority/path。
对于HDFS来说:scheme是hdfs;
对于本地FS来说:scheme是file
scheme和authority是可选的,如果未指定,则使用配置中指定的默认方案
对于HDFS,命令示例如下:
Hadoop fs -ls hdfs://namenode:host/parent/child
Hadoop fs -ls /parent/child fs.defaultFS中有配置
对于本地文件系统命令示例如下
Hadoop fs -ls file:///root
如果使用的文件系统是HDFS,则使用hdfs dfs也是可以的,此时
Hadoop fs <args> = hdfs dfs <args>
三、shell常用命令
1、-ls
功能:
显示文件、目录信息
使用:
hadoop fs -ls [-h](human给大小加上了单位) <args>
示例:
hadoop fs -ls /hello
hadoop fs -ls -h /hello
2、-mkdir
功能:
在hdfs上创建目录,-p表示会创建路径中的各级父目录。
使用:
hadoop fs -mkdir [-p] <paths>
示例:
hadoop fs -mkdir -p /hello/hello1/hello2
3、-put
功能:
将单个文件或多个文件从本地文件系统复制(上传)到目标文件系统
使用:
hadoop fs -put [-f] [-p] 本地文件目录 目标文件目录
-p:表示保留访问和修改时间,所有权和权限
-f:覆盖目的地(如果已经存在)
示例:
hadoop fs -put /root/install.log.syslog /
4、-get
功能:
将文件复制(下载)到本地文件系统
使用:
hadoop fs -get [ignorecrc] [-crc] [-p] [-f] 文件系统目录 本地文件保 存目录
-ignorecrc:跳过对下载文件的CRC检查
-crc:为下载的文件写CRC效验和
示例:
hadoop fs -get /install.log.syslog ./(当前目录)
5、-appendToFile
功能:
追加一个文件到已经存在的文件末尾
使用:
hadoop fs -appendToFile 本地文件目录 目标文件目录
示例:
hadoop fs -appendToFile 2.txt /1.txt
6、-cat
功能:
显示文件内容
使用:
hadoop fs -cat 文件目录
示例:
hadoop fs -cat /1.txt
7、-tail
功能:
查看文件的最后一千字内容
使用:
hadoop fs -tail [-f] 目录
示例:
hadoop fs -tail /hadoop/hadoopfile
8、-getmerge
功能:
合并下在多个文件
示例:
比如hdfs目录 /aaa下多个文件:log.1, log.12, log.3
Hadoop fs -getmerge /aaa/log.* ./log.sum
9、-setrep
功能:改变一个文件的副本系数。-R 选项用于递归改变目录下所有文件的副本系数
示例:hadoop fs -setrep -w 3(副本个数) [-R(一个文件不用写)] /user/hadoop/dir1
HDFS基础1的更多相关文章
- Hadoop学习笔记—2.不怕故障的海量存储:HDFS基础入门
一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...
- 每天收获一点点------Hadoop之HDFS基础入门
一.HDFS出现的背景 随着社会的进步,需要处理数据量越来越多,在一个操作系统管辖的范围存不下了,那么就分配到更多的操作系统管理的磁盘中,但是却不方便管理和维护—>因此,迫切需要一种系统来管理多 ...
- HDFS基础配置
HADOOP-3.1.0-----HDFS基础配置 执行步骤:(1)配置集群(2)启动.测试集群增.删.查(3)执行wordcount案例 一.配置集群 1.在 hadoop-env.sh配置文件添加 ...
- HDFS基础
1. HDFS Shell基础 [root@master hadoop]# hadoop fsUsage: hadoop fs [generic options] [-appendToFile < ...
- Hadoop学习之路(六)HDFS基础
HDFS前言 HDFS:Hadoop Distributed File System ,Hadoop分布式文件系统,主要用来解决海量数据的存储问题 设计思想 1.分散均匀存储 dfs.blocksiz ...
- Hadoop系列-HDFS基础
基本原理 HDFS(Hadoop Distributed File System)是Hadoop的一个基础的分布式文件系统,这个分布式的概念主要体现在两个地方: 数据分块存储在多台主机 数据块采取冗余 ...
- Hadoop学习之路(二)HDFS基础
1.HDFS前言 HDFS:Hadoop Distributed File System,Hadoop分布式文件系统,主要用来解决海量数据的存储问题. 设计思想 分散均匀存储 dfs.blocksiz ...
- HDFS基础和java api操作
1. 概括 适合一次写入多次查询情况,不支持并发写情况 通过hadoop shell 上传的文件存放在DataNode的block中,通过linux shell只能看见block,看不见文件(HDFS ...
- hadoop - hdfs 基础操作
hdfs --help # 所有参数 hdfs dfs -help # 运行文件系统命令在Hadoop文件系统 hdfs dfs -ls /logs # 查看 hdfs dfs -ls /user/ ...
随机推荐
- servletsza
servlet本身不能独立运行,需要在一个web应用中运行,而web应用是部署在tomcat上的 所以一个servlet开发需要以下几个步骤: ①创建web应用项目 ②编写servlet代码 ③部署到 ...
- 在webpack3里使用uglifyjs
环境:webpac<4的场景下,安装uglifyjs. cnpm install uglifyjs-webpack-plugin -D 安装完毕后,去npm里查看uglifyjs的使用方法并添加 ...
- 微信小程序分享及信息追踪
我就是个搬用工—来源:https://www.jianshu.com/p/87a75ec2fd53 小程序分享群及信息追踪 需求 页面分享 小程序页面分享链接增加source参数,值为用户ID加密 ...
- 322. Coin Change零钱兑换
网址:https://leetcode.com/problems/coin-change/ 典型的动态规划问题,类比背包问题,这就是完全背包问题 问题的阶段:对数值 i 凑硬币 问题的状态:对数值 i ...
- java.lang.NumberFormatException错误及解决方法
java.lang.NumberFormatException 一般由Integer.valueOf(String param)或者Integer.parseInt(String param)引起 不 ...
- centos7与centos6命令区别
CentOS 7 vs CentOS 6的不同 (1)桌面系统[CentOS6] GNOME 2.x[CentOS7] GNOME 3.x(GNOME Shell) (2)文件系统[CentOS ...
- 二叉树之AVL树
高度为 h 的 AVL 树,节点数 N 最多2^h − 1: 最少N(h)=N(h− 1) +N(h− 2) + 1. 最少节点数n 如以斐波那契数列可以用数学归纳法证明: 即: N(0) = 0 ( ...
- Hugo + github 搭建个人博客
前言 很早以前就有想法,搭建一个个人的博客.没有实现的原因:一方面个人的服务器不太安全掉线,欠费,维护起来麻烦,另一方面,文章编辑发布起来也不方便. 后来了解到 github 提供了博客的功能,也一直 ...
- 将一个js项目改造成vue项目
本地环境:node版本:8.11.4 vue版本:3.4.1; 开发工具vscode 1.创建一个空的vue项目(vue create bigdata_reprot_web) 2.找到项目的空白页,改 ...
- elk的一些零碎知识
1.elasticsearch检查是否健康 http://12.20.511.141:9200/_cat/health?v 绿色表示一切正常, 黄色表示所有的数据可用但是部分副本还没有分配,红色表示部 ...