项目需求

导出生成大批量数据的文件，一个Excel中最多存有五十万条数据，查询多余五十万的数据写多个Excel中。导出完成是生成的多个Excel文件打包压缩成zip，而后更新导出记录中的压缩文件路径。

大数据量文件一般采用异步生成文件，导出时首先授权生成一个流水号，而后将数据携带流水号请求导出接口。

抛开实际业务，做成一个比较公共的导出功能。

参数说明

{

    "className": "ValideData",         //导出的数据的实体类，类中有别名和顺序相关的注解

    "createUser": "",				//操作人

    "downLoadNo": "202203181504732568468066304",  	//下载流水号

    "fileName": "机卡绑定",          //文件名      fileName+HHmmssSSS.xlsx

    "keys": [						//redis key的数据，分批获取数据

    ],

    "remark": "机卡绑定",				//备注（不关注）

    "type": "机卡绑定"					//导出类型（不关注）

}

坐标

<dependency>

  <groupId>org.apache.commons</groupId>

  <artifactId>commons-compress</artifactId>

  <version>1.21</version>

</dependency>

注：抛开导出前的参数校验，只关注导出操作。

主要代码

逻辑说明：

导出前将请求参数更新到导出记录中。
类加载器加载需要导出数据的实体类
设置一个数据量指针，记录到每个文件的数据量
达到阈值时指定文件写出到磁盘并清缓。
重置数据量指针，新增一条文件记录（循环）
数据量指针未到阈值时但数据已经查询完成---->>写入剩余数据
查询该流水号的所有文件记录
压缩文件并返回压缩文件地址
更新到导出记录中

主流程

public void bigDataExport(PortDto dto) throws Exception {

    long start = System.currentTimeMillis();

    log.info("开始导出，批次号：<{}>, 开始时间：{}", dto.getDownLoadNo(), DateUtil.now());

    //修改导出记录

    LambdaUpdateWrapper<PortDto> updateWrapper = new LambdaUpdateWrapper<>();

    updateWrapper.eq(PortDto::getDownLoadNo, dto.getDownLoadNo());

    //生成导出记录

    int row = this.baseMapper.update(dto, updateWrapper);

    if (row > 0) {

        log.info("批次号：<{}>准备生成文件", dto.getDownLoadNo());

        try {

            Iterator<String> iterator = keys.iterator();

            Workbook workbook = null;

            ExportParams params = new ExportParams();

            //加载导出数据实体类

            Class<?> aClass = Class.forName(entityBasePackage + dto.getClassName());

            int element = 0;

            while (iterator.hasNext()) {

                String key = iterator.next();

                Collection<?> list = getList(key, aClass);

                element += list.size();

                workbook = ExcelExportUtil.exportBigExcel(params, aClass, list);

                //文件数据达到阈值

                if (element >= maxDataCount) {

                    String fileName = dto.getFileName() + "_" + DateUtil.format(new Date(),

                            "HHmmssSSS") + ".xlsx";

                    ExcelExportUtil.closeExportBigExcel();

                    FileOutputStream fos =

                            new FileOutputStream(fileProp.getPath().getPath() + fileName);

                    workbook.write(fos);

                    fos.close();

                    element = 0;

                    //更新地址

                    Map<String, Object> map = new HashMap<>();

                    map.put("downloadNo", dto.getDownLoadNo());

                    map.put("filePath", fileProp.getPath().getPath() + fileName);

                    map.put("createTime", new Date());

                    this.baseMapper.insertPathRecord(map);

                    log.info("文件写入完成，文件名：{}", fileName);

                    continue;

                }

                iterator.remove();

            }

            //写入剩余文件

            if (element != 0) {

                String fileName = dto.getFileName() + "_" + DateUtil.format(new Date(),

                        "HHmmssSSS") + ".xlsx";

                ExcelExportUtil.closeExportBigExcel();

                FileOutputStream fos = new FileOutputStream(fileProp.getPath().getPath() + fileName);

                workbook.write(fos);

                fos.close();

                element = 0;

                //更新地址

                Map<String, Object> map = new HashMap<>();

                map.put("downloadNo", dto.getDownLoadNo());

                map.put("filePath", fileProp.getPath().getPath() + fileName);

                map.put("createTime", new Date());

                this.baseMapper.insertPathRecord(map);

                log.info("文件写入完成，文件名：{}", fileName);

            }

            long end = System.currentTimeMillis();

            log.info("导出结束，批次号：<{}>, 结束时间：{}， 耗时：{}", dto.getDownLoadNo(), DateTime.of(end),

                    DateUtil.formatBetween(end - start));

        } catch (Exception e) {

            log.info("批次号<{}>导出异常：", dto.getDownLoadNo(), e);

            throw new BusinessException("");

        } finally {

            log.info("批次号<{}>生成文件结束，准备压缩文件，修改状态", dto.getDownLoadNo());

            //合并文件到导出文件记录主表

            //当只有一个文件记录时直接更新主表文件地址

            List<PortDto> recordList = exportDao.getPathRecord(dto);

            if (recordList.size() > 1) {

                //zipPath

                dto.setFilePath(zcat(dto, recordList));

            } else {

                //xlsxPath

                dto.setFilePath(recordList.size()==0? "":recordList.get(0).getFilePath());

            }

            updateWrapper.clear();

            updateWrapper.set(PortDto::getFilePath, dto.getFilePath());

            updateWrapper.set(PortDto::getSuccessTime, new Date());

            updateWrapper.set(PortDto::getStatus, "1");

            updateWrapper.eq(PortDto::getDownLoadNo, dto.getDownLoadNo());

            this.baseMapper.update(null, updateWrapper);

            log.info("批次号<{}>更新下载记录表文件地址，修改状态成功", dto.getDownLoadNo());

        }

    }

}

文件压缩

/**

 *  多文件压缩

 * @param dto 导出信息

 * @Param recordList 文件路径

 * @return void

 * @throws

 * @author Surpass

 * @date 2022/3/17 9:59

 */

private String zcat(PortDto dto, List<PortDto> recordList) throws Exception {

    String fileName = dto.getFileName() + "_" + DateUtil.format(new Date(), "HHmmssSSS") + ".zip";

    String zipPath = fileProp.getPath().getPath() + fileName;

    Archiver archiver = CompressUtil.createArchiver(

            CharsetUtil.CHARSET_UTF_8,

            ArchiveStreamFactory.ZIP,

            new File(zipPath)

    );

    for (PortDto portDto : recordList) {

        archiver.add(FileUtil.file(portDto.getFilePath()));

    }

    archiver.finish();

    archiver.close();

    return zipPath;

}

查询数据

/**

 *   查询redis数据

 * @param key

 * @param cls

 * @return java.util.Collection<?>

 * @throws

 * @author Surpass

 * @date 2022/3/18 15:51

 */

private Collection<?> getList(String key, Class<?> cls) {

    List<String> list = redis.getList(key);

    return list.stream().map(item -> JSONObject.parseObject(item, cls)).collect(Collectors.toList());

}

补充

导出还设置了队列计数器来限制同一时间最大的导出请求，使用aop在申请流水号时计数器+1，导出完成或者异常时队列计数器-1。导出完成后根据操作人发送邮件通知导出结果。

Export大数据量导出和打包的更多相关文章

poi 操作Excel 以及大数据量导出
maven 依赖 (版本必须一致,否则使用SXSSFworkbook 时程序会报错) <dependency> <groupId>org.apache.poi</grou ...
SQL Server 使用bcp进行大数据量导出导入
转载:http://www.cnblogs.com/gaizai/archive/2010/04/17/1714389.html SQL Server的导出导入方式有: 在SQL Server中提供了 ...
使用内存映射文件MMF实现大数据量导出时的内存优化
前言导出功能几乎是所有应用系统必不可少功能,今天我们来谈一谈,如何使用内存映射文件MMF进行内存优化,本文重点介绍使用方法,相关原理可以参考文末的连接实现我们以单次导出一个excel举例(csv ...
EasyPoi大数据导入导出百万级实例
EasyPoi介绍: 利用注解的方式简化了Excel.Word.PDF等格式的导入导出,而且是百万级数据的导入导出.EasyPoi官方网址:EasyPoi教程_V1.0 (mydoc.io).下面我写 ...
java 导出Excel 大数据量，自己经验总结！
出处: http://lyjilu.iteye.com/ 分析导出实现代码,XLSX支持: /** * 生成<span style="white-space: normal; back ...
NPOI大数据量多个sheet导出源码（原）
代码如下: #region NPOI大数据量多个sheet导出 /// <summary> /// 大数据量多个sheet导出 /// </summary> /// <t ...
java excel大数据量导入导出与优化
package com.hundsun.ta.utils; import java.io.File; import java.io.FileOutputStream; import java.io.I ...
POI3.8解决导出大数据量excel文件时内存溢出的问题
POI3.8的SXSSF包是XSSF的一个扩展版本,支持流处理,在生成大数据量的电子表格且堆空间有限时使用.SXSSF通过限制内存中可访问的记录行数来实现其低内存利用,当达到限定值时,新一行数据的加入 ...
elasticsearch5.0集群大数据量迁移方法及注意事项
当es集群的数据量较小的情况下elasticdump这个工具比较方便,但是当数据量达到一定级别比如上百G的时候,elasticdump速度就很慢了,此时我们可以使用快照的方法进行备份 elasticd ...

随机推荐

【转】linux shell编程实例总结
查找当前目录中所有大于500M的文件,把这些文件名写到一个文本文件中,并统计其个数 find ./ -size +500M -type f | tee file_list | wc 在目录/tmp下找 ...
[转]API性能测试基本性能指标及要求
原文链接http://blog.csdn.net/strawbingo/article/details/46458959 指标的基本概念 1.事务(Transaction) 在web性能测试中,一个事 ...
区区牛马蹉跎，不要向生活低下头 Linux的账号和管理
账户和管理权限 1.管理用户账号和组账号 2.管理目录和文件的属性 1.Linux基于用户身份对资源访问进行控制:用户账号(超级用户.普通用户.程序用户) 组账号(基本组.附加组).UID (用户标识 ...
Solution -「ARC 104E」Random LIS
\(\mathcal{Description}\) Link. 给定整数序列 \(\{a_n\}\),对于整数序列 \(\{b_n\}\),\(b_i\) 在 \([1,a_i]\) 中等概率 ...
Unreal ListView使用篇
应用 ListView,在Unreal UI界面开发中用途非常广泛,基本只要你使用列表,就得需要用ListView.比如排行榜100个列表,界面上只需要显示出10个,我们肯定不能生成100个ui实例, ...
使用docker部署awx-1.7.1.0（ansible图形化界面）
文章目录关于环境下载awx 下载安装所需依赖安装docker-compose 配置inventory文件出现的报错 TASK [local_docker : Run migrations in ...
TensorFlow优化器浅析
本文基于tensorflow-v1.15分支,简单分析下TensorFlow中的优化器. optimizer = tf.train.GradientDescentOptimizer(learning_ ...
tip5：tomcat9日志及控制台中文乱码
1.conf/logging.properties文件所有UTF-8相关全部注释 2.bin/catalina.bat文件中添加set "JAVA_OPTS=-server -Dfile.e ...
GoJS 使用笔记
作为商业软件,GoJs很容易使用,文档也很完备,不过项目中没有时间系统地按照文档学习,总是希望快速入门使用,所以将项目中遇到的问题精简一下,希望对后来者有些帮助. 开始使用这里先展示一个最简单的例子 ...
Nginx-反向代理服务器
概述 Nginx是一款轻量级的Web服务器.反向代理服务器,由于它的内存占用少,启动极快,高并发能力强,在互联网项目中广泛应用. 优点 nginx是多进程的,不会出现并发问题,不用加锁.一个进程出问题 ...

Export大数据量导出和打包