在java(JDK)中我们可以使用ZipOutputStream去创建zip压缩文件,(参考我之前写的文章 使用java API进行zip递归压缩文件夹以及解压 ),也可以使用GZIPOutputStream去创建gzip(gz)压缩文件,但是java中没有一种官方的API可以去创建tar.gz文件。所以我们需要使用到第三方库Apache Commons Compress去创建.tar.gz文件。

在pom.xml中,我们可以通过如下的maven坐标引入commons-compress。

  1. <dependency>
  2. <groupId>org.apache.commons</groupId>
  3. <artifactId>commons-compress</artifactId>
  4. <version>1.20</version>
  5. </dependency>

解释说明

  1. tar文件准确的说是打包文件,将文件打包到一个tar文件中,文件名后缀是.tar
  2. Gzip是将文件的存储空间压缩保存,文件名后缀是.gz
  3. tar.gz.tgz通常是指将文件打包到一个tar文件中,并将它使用Gzip进行压缩。

如果您阅读完本文觉得对您有帮助的话,请给我一个赞,您的支持是我不竭的创作动力!

一、将两个文件打包到tar.gz

下面的这个例子是将2个文件打包为tar.gz压缩文件。下文代码中的流操作使用了try-with-resources语法,所以不用写代码手动的close流。

  1. import org.apache.commons.compress.archivers.tar.TarArchiveEntry;
  2. import org.apache.commons.compress.archivers.tar.TarArchiveOutputStream;
  3. import org.apache.commons.compress.compressors.gzip.GzipCompressorOutputStream;
  4. import org.junit.jupiter.api.Test;
  5. import java.io.BufferedOutputStream;
  6. import java.io.IOException;
  7. import java.io.OutputStream;
  8. import java.nio.file.Files;
  9. import java.nio.file.Path;
  10. import java.nio.file.Paths;
  11. import java.util.Arrays;
  12. import java.util.List;
  13. public class TarGzTest {
  14. @Test
  15. void testFilesTarGzip() throws IOException {
  16. //输入文件,被压缩文件
  17. Path path1 = Paths.get("/home/test/file-a.xml");
  18. Path path2 = Paths.get("/home/test/file-b.txt");
  19. List<Path> paths = Arrays.asList(path1, path2);
  20. //输出文件压缩结果
  21. Path output = Paths.get("/home/test/output.tar.gz");
  22. //OutputStream输出流、BufferedOutputStream缓冲输出流
  23. //GzipCompressorOutputStream是gzip压缩输出流
  24. //TarArchiveOutputStream打tar包输出流(包含gzip压缩输出流)
  25. try (OutputStream fOut = Files.newOutputStream(output);
  26. BufferedOutputStream buffOut = new BufferedOutputStream(fOut);
  27. GzipCompressorOutputStream gzOut = new GzipCompressorOutputStream(buffOut);
  28. TarArchiveOutputStream tOut = new TarArchiveOutputStream(gzOut)) {
  29. //遍历文件list
  30. for (Path path : paths) {
  31. //该文件不是目录或者符号链接
  32. if (!Files.isRegularFile(path)) {
  33. throw new IOException("Support only file!");
  34. }
  35. //将该文件放入tar包,并执行gzip压缩
  36. TarArchiveEntry tarEntry = new TarArchiveEntry(
  37. path.toFile(),
  38. path.getFileName().toString());
  39. tOut.putArchiveEntry(tarEntry);
  40. Files.copy(path, tOut);
  41. tOut.closeArchiveEntry();
  42. }
  43. //for循环完成之后,finish-tar包输出流
  44. tOut.finish();
  45. }
  46. }
  47. }

file-a.xmlfile-b.txt打包到output.tar文件中,并使用gzip对这个tar包进行压缩。可以使用如下命令查看tar包里面包含的文件。

  1. $ tar -tvf /home/test/output.tar.gz
  2. -rw-r--r-- 0/0 23546 2020-08-17 12:07 file-a.xml
  3. -rw-r--r-- 0/0 34 2020-08-17 12:36 file-b.txt

二、将一个文件夹压缩为tar.gz

下面的例子将一个文件夹,包含其子文件夹的文件或子目录,打包为tar,并使用gzip进行压缩。最终成为一个tar.gz打包压缩文件。

其核心原理是:使用到Files.walkFileTree依次遍历文件目录树中的文件,将其一个一个的添加到TarArchiveOutputStream.输出流。

  1. @Test
  2. void testDirTarGzip() throws IOException {
  3. // 被压缩打包的文件夹
  4. Path source = Paths.get("/home/test");
  5. //如果不是文件夹抛出异常
  6. if (!Files.isDirectory(source)) {
  7. throw new IOException("请指定一个文件夹");
  8. }
  9. //压缩之后的输出文件名称
  10. String tarFileName = "/home/" + source.getFileName().toString() + ".tar.gz";
  11. //OutputStream输出流、BufferedOutputStream缓冲输出流
  12. //GzipCompressorOutputStream是gzip压缩输出流
  13. //TarArchiveOutputStream打tar包输出流(包含gzip压缩输出流)
  14. try (OutputStream fOut = Files.newOutputStream(Paths.get(tarFileName));
  15. BufferedOutputStream buffOut = new BufferedOutputStream(fOut);
  16. GzipCompressorOutputStream gzOut = new GzipCompressorOutputStream(buffOut);
  17. TarArchiveOutputStream tOut = new TarArchiveOutputStream(gzOut)) {
  18. //遍历文件目录树
  19. Files.walkFileTree(source, new SimpleFileVisitor<Path>() {
  20. //当成功访问到一个文件
  21. @Override
  22. public FileVisitResult visitFile(Path file,
  23. BasicFileAttributes attributes) throws IOException {
  24. // 判断当前遍历文件是不是符号链接(快捷方式),不做打包压缩处理
  25. if (attributes.isSymbolicLink()) {
  26. return FileVisitResult.CONTINUE;
  27. }
  28. //获取当前遍历文件名称
  29. Path targetFile = source.relativize(file);
  30. //将该文件打包压缩
  31. TarArchiveEntry tarEntry = new TarArchiveEntry(
  32. file.toFile(), targetFile.toString());
  33. tOut.putArchiveEntry(tarEntry);
  34. Files.copy(file, tOut);
  35. tOut.closeArchiveEntry();
  36. //继续下一个遍历文件处理
  37. return FileVisitResult.CONTINUE;
  38. }
  39. //当前遍历文件访问失败
  40. @Override
  41. public FileVisitResult visitFileFailed(Path file, IOException exc) {
  42. System.err.printf("无法对该文件压缩打包为tar.gz : %s%n%s%n", file, exc);
  43. return FileVisitResult.CONTINUE;
  44. }
  45. });
  46. //for循环完成之后,finish-tar包输出流
  47. tOut.finish();
  48. }
  49. }

三、解压tar.gz压缩文件

下面一个例子说明如何解压一个tar.gz文件,具体内容请看代码注释。

  1. @Test
  2. void testDeCompressTarGzip() throws IOException {
  3. //解压文件
  4. Path source = Paths.get("/home/test/output.tar.gz");
  5. //解压到哪
  6. Path target = Paths.get("/home/test2");
  7. if (Files.notExists(source)) {
  8. throw new IOException("您要解压的文件不存在");
  9. }
  10. //InputStream输入流,以下四个流将tar.gz读取到内存并操作
  11. //BufferedInputStream缓冲输入流
  12. //GzipCompressorInputStream解压输入流
  13. //TarArchiveInputStream解tar包输入流
  14. try (InputStream fi = Files.newInputStream(source);
  15. BufferedInputStream bi = new BufferedInputStream(fi);
  16. GzipCompressorInputStream gzi = new GzipCompressorInputStream(bi);
  17. TarArchiveInputStream ti = new TarArchiveInputStream(gzi)) {
  18. ArchiveEntry entry;
  19. while ((entry = ti.getNextEntry()) != null) {
  20. //获取解压文件目录,并判断文件是否损坏
  21. Path newPath = zipSlipProtect(entry, target);
  22. if (entry.isDirectory()) {
  23. //创建解压文件目录
  24. Files.createDirectories(newPath);
  25. } else {
  26. //再次校验解压文件目录是否存在
  27. Path parent = newPath.getParent();
  28. if (parent != null) {
  29. if (Files.notExists(parent)) {
  30. Files.createDirectories(parent);
  31. }
  32. }
  33. // 将解压文件输入到TarArchiveInputStream,输出到磁盘newPath目录
  34. Files.copy(ti, newPath, StandardCopyOption.REPLACE_EXISTING);
  35. }
  36. }
  37. }
  38. }
  39. //判断压缩文件是否被损坏,并返回该文件的解压目录
  40. private Path zipSlipProtect(ArchiveEntry entry,Path targetDir)
  41. throws IOException {
  42. Path targetDirResolved = targetDir.resolve(entry.getName());
  43. Path normalizePath = targetDirResolved.normalize();
  44. if (!normalizePath.startsWith(targetDir)) {
  45. throw new IOException("压缩文件已被损坏: " + entry.getName());
  46. }
  47. return normalizePath;
  48. }

欢迎关注我的博客,里面有很多精品合集

  • 本文转载注明出处(必须带连接,不能只转文字):字母哥博客

觉得对您有帮助的话,帮我点赞、分享!您的支持是我不竭的创作动力! 。另外,笔者最近一段时间输出了如下的精品内容,期待您的关注。

使用Java API进行tar.gz文件及文件夹压缩解压缩的更多相关文章

  1. Delphi - Windows系统下,Delphi调用API函数和7z.dll动态库,自动把文件压缩成.tar.gz格式的文件

    项目背景 应欧美客户需求,需要将文件压缩成.tar.gz格式的文件,并上传给客户端SFTP服务器. 你懂的,7-Zip软件的显著特点是文件越大压缩比越高,在Linux系统上相当于我们Windows系统 ...

  2. xlslib安装, aclocal-1.13: command not found, 安装升级autoconf-2.65.tar.gz, automake-1.13.tar.gz两个文件

    问题1: $ make CDPATH="${ZSH_VERSION+.}:" && cd . && aclocal-1.13 -I m4 /bin/ ...

  3. 第一章:pip 安装 tar.gz 结尾的文件 和 .whl 结尾的文件

    1. 假如后缀中还有 .tar.gz 的文件通过 pip 命令进行安装步骤. .单击 .tar.gz结尾的文件,并且对文件进行解压,进入到解压目录中,通过python命令进行安装. 命令如下:在dos ...

  4. 如何将文件压缩成.tar.gz格式的文件

    1.下载“7-ZIP“这个软件 2.安装7-ZIP以后,直接在你想要打包的文件上点右键菜单,会有一个7-ZIP的子菜单栏,类似WinRAR和WinZIP的那种右键菜单.然后选“7-ZIP”->“ ...

  5. Linux压缩解压 tar.gz格式的文件.查看tomcat是否运行

    tar命令详解 -c: 建立压缩档案 -x:解压 -t:查看内容 -r:向压缩归档文件末尾追加文件 -u:更新原压缩包中的文件 这五个是独立的命令,压缩解压都要用到其中一个,可以和别的命令连用但只能用 ...

  6. linux中解压缩并安装.tar.gz后缀的文件

    1.解压缩: Linux下以tar.gz为扩展名的软件包,是用tar程序打包并用gzip程序压缩的软件包.要安装这种软件包,需要先对软件包进行解压缩,使用“tar -zxfv filename.tar ...

  7. 【java】 java 解压tar.gz读取内容

    package com.xwolf.stat.util; import com.alibaba.druid.util.StringUtils; import com.alibaba.fastjson. ...

  8. 不解压查看tar.gz包内文件

    通过tar命令备份.解压缩文件,也可在不解压缩文件时查看包内的文件信息. 使用如下参数: tar -ztvf file.tar.gz 将列出所有包内的文件列表,包括目录 -z, --gzip, --g ...

  9. tar、7z(7zip)压缩/解压缩指令的使用

    本文介绍tar.7z指令的使用方法 tar指令 在Linux中,使用的最多的压缩/解压缩指令就是tar指令了. tar指令用来将多个文件/目录结构打包.在实际使用中,往往使用tar对压缩的支持,即同时 ...

随机推荐

  1. 深入理解JVM(二)垃圾收集器

    GC三问: 哪些内存需要回收? 什么时候回收? 如何回收? 程序计数器.虚拟机栈.本地方法栈随线程而生,随线程而灭,栈帧的内存分配在类结构确定下来就已知,在方法结束或者线程结束时就会回收.所以垃圾回收 ...

  2. css中的名词

    用到的单词 current 当前 hover 悬停 selected 挑选 disabled 禁用 focus 得到焦点 blur 失去焦点 checked 勾选 success 成功 error 出 ...

  3. 在Dockerfile中使用和“Source”的Run指令不起作用?

    报错误 /bin/sh: 1: source: not found sh不支持source bash支持source RUN rm /bin/sh && ln -s /bin/bash ...

  4. 关于RecyclerView(一)基本使用

    前言 最近在项目中用到了ListView,不知道为什么总是出现数据错乱的情况,另外RecyclerView包含很多Item动画,所以改成了RecyclerView. 简单使用 RecyclerView ...

  5. Python 为什么要有 pass 语句?

    本文出自"Python为什么"系列,请查看全部文章 关于 Python 中的pass语句,它似乎很简单(只有 4 个字母),即使是没有任何编程经验的初学者也能很快地掌握它的用法. ...

  6. Day17_购物车

    学于黑马和传智播客联合做的教学项目 感谢 黑马官网 传智播客官网 微信搜索"艺术行者",关注并回复关键词"乐优商城"获取视频和教程资料! b站在线视频 注:实验 ...

  7. Python File readline() 方法

    概述 readline() 方法用于从文件读取整行,包括 "\n" 字符.如果指定了一个非负数的参数,则返回指定大小的字节数,包括 "\n" 字符.高佣联盟 w ...

  8. PHP import_request_variables() 函数

    import_request_variables() 函数将 GET/POST/Cookie 变量导入到全局作用域中.该函数在最新版本的 PHP 中已经不支持.高佣联盟 www.cgewang.com ...

  9. PHP imageantialias - 是否使用抗锯齿(antialias)功能

    imageantialias — 是否使用抗锯齿(antialias)功能.高佣联盟 www.cgewang.com 语法 bool imageantialias ( resource $image ...

  10. MOS 预夹断到底是什么

    https://www.cnblogs.com/yeungchie/ MOS管就像一个开关,栅极(Gate)决定源极(Souce)到漏极(Drain)的沟道(Channel)是开还是关.以NMOS为例 ...