背景:接手的项目中支持导出一批数据,全数量在50W左右。在接手的时候看代码是直接一次查询MySQL获得数据,然后用header函数直接写入csv,用户开始导出则自动下载。但是,在全导出的时候,功能出现了BUG问题。

1.数据量大导致PHP处理脚本运行时间,超过默认限制。

2.数据量过大,导致内存溢出,流程中止。

初版解决方案:

1.通过函数set_time_limit(0);       取消执行时间限制(在导出的函数入口设置,这是合理的,导出的数据量过大了)

2.关于数据过大,内存溢出的解决办法,开始是想到了php动态变量(先由sql语句获得总记录数,然后每2W条切分,查询2w条数据存入一个变量)

  1. $total_export_count = $db->getOne("select count(1) from ($sql) t2");
  2. for ($i=0;$i<intval($total_export_count/20000)+1;$i++){
  3. $export_data = "exportdata".$i;
  4. $$export_data = $db->getAll($sql." limit ".strval($i*20000).",20000");
  5. }

然后通过相应的代码取出变量的信息,echo到csv文件中,这种方式在本地测试的时候是通过的,但在服务器上依旧会内存溢出。

  1. header ( "Content-type:application/vnd.ms-excel" );
  2. header ( "Content-Disposition:filename=" . iconv ( "UTF-8", "GB18030", "查询用户列表" ) . ".csv" );
  3. $out = $column_name;
  4. echo iconv ( "UTF-8", "GB18030", $out );
  5. for ($i=0;$i<intval($total_export_count/20000)+1;$i++){
  6. $dynamic_name = "exportdata".$i;
  7. foreach ( $$dynamic_name as $key => $item ) {
  8. echo iconv ( "UTF-8", "GB18030", "\n".implode(',',$item) );
  9. }
  10. // 将已经写到csv中的数据存储变量销毁,释放内存占用
  11. unset($$dynamic_name);
  12. }
  13. exit ();

因为上面的方法在服务器上没有通过,所以只能将分割数据量的操作放到写文件的流程中,相比上面的思路这种会慢一些。

  1. header ( "Content-type:application/vnd.ms-excel" );
  2. header ( "Content-Disposition:filename=" . iconv ( "UTF-8", "GB18030", "查询用户列表" ) . ".csv" );
  3. $out = $column_name;
  4. echo iconv ( "UTF-8", "GB18030", $out );
  5. $pre_count = 20000;
  6. for ($i=0;$i<intval($total_export_count/$pre_count)+1;$i++){
  7. $export_data = $db->getAll($sql." limit ".strval($i*$pre_count).",{$pre_count}");
  8. foreach ( $export_data as $key => $item ) {
  9. echo iconv ( "UTF-8", "GB18030", "\n".implode(',',$item) );
  10. }
  11. // 将已经写到csv中的数据存储变量销毁,释放内存占用
  12. unset($export_data);
  13. }
  14. exit ();

经测试之后是可行的,服务器上也可以导出,就是时间会慢一些,而且会是一直下载状态。

关于这个场景整理了一些资料:

1.csv文件的条数是好像没有限制的,可以一直写(网上的博文里面看的,没证实过)

2.excel 2010版本以上,是可以读取100多W行数据的(验证过,新建一个excel,ctrl+下箭头  到文件末尾可以看到行数)

理想的解决方案(没有具体实施,想的)

1.数据分割肯定是必须的步骤,防止内存溢出。

2.将分割后的数据写入到一个excel或者一个csv文件中,被分割了多少次,写多少个文件。这样可以防止达到文件行数的最大限制。

3.将2中写的文件进行压缩处理,压缩成一个压缩包,然后进行自动下载。

补充:

在上面的方案正式运行的时候发现导出的数据,总是比查询的总记录数要少1000多条,几次看数据后发现有些数据并没有换行,而是写到上一行去了。在有了这个觉悟后,重新看了遍之前转别人的帖子,发现还是用fputcsv()函数比较靠谱,传入一个数组,作为一行的数据,由该函数自己去写换行和控列。感觉有些时候还是不要偷懒的好啊,虽然自己写","完成列分割,写"\n"完成空格,貌似是可行的,但是对于一些数据,并不一定能控制的好。

修改后的导出代码:

  1. header ( "Content-type:application/vnd.ms-excel" );
  2. header ( "Content-Disposition:filename=" . iconv ( "UTF-8", "GB18030", "query_user_info" ) . ".csv" );
  3. // 打开PHP文件句柄,php://output 表示直接输出到浏览器
  4. $fp = fopen('php://output', 'a');
  5. // 将中文标题转换编码,否则乱码
  6. foreach ($column_name as $i => $v) {
  7. $column_name[$i] = iconv('utf-8', 'GB18030', $v);
  8. }
  9. // 将标题名称通过fputcsv写到文件句柄
  10. fputcsv($fp, $column_name);
  11. $pre_count = 10000;
  12. for ($i=0;$i<intval($total_export_count/$pre_count)+1;$i++){
  13. $export_data = $db->getAll($sql." limit ".strval($i*$pre_count).",{$pre_count}");
  14. foreach ( $export_data as $item ) {
  15. $rows = array();
  16. foreach ( $item as $export_obj){
  17. $rows[] = iconv('utf-8', 'GB18030', $export_obj);
  18. }
  19. fputcsv($fp, $rows);
  20. }
  21. // 将已经写到csv中的数据存储变量销毁,释放内存占用
  22. unset($export_data);
  23. ob_flush();
  24. flush();
  25. }
  26. exit ();

php 用csv文件导出大量数据初方案的更多相关文章

  1. [转载] php用csv文件导出大量数据

    header ( "Content-type:application/vnd.ms-excel" ); header ( "Content-Disposition:fil ...

  2. python使用pymongo访问MongoDB的基本操作,以及CSV文件导出

    1. 环境. Python:3.6.1 Python IDE:pycharm 系统:win7 2. 简单示例 import pymongo # mongodb服务的地址和端口号mongo_url = ...

  3. 将CSV文件中的数据导入到SQL Server 数据库中

    导入数据时,需要注意 CSV 文件中的数据是否包含逗号以及双引号,存在时,导入会失败 选择数据库 -> 右键 -> 任务 -> 导入数据 ,然后根据弹出的导入导出向导(如下图)中的提 ...

  4. csv文件批量导入数据到sqlite。

    csv文件批量导入数据到sqlite. 代码: f = web.input(bs_switch = {})  # bs_switch 为from表单file字段的namedata =[i.split( ...

  5. MySQL添加CSV文件中的数据

    一.MySQL添加csv数据 此问题是前几天整理数据的时候碰到的,数据存在 CSV文件中(200多万记录),通过python 往数据库中导入太慢了,后来使用MySQL 中自带的命令 LOAD DATA ...

  6. 基于CentOS的MySQL学习补充四--使用Shell批量从CSV文件里插入数据到数据表

    本文出处:http://blog.csdn.net/u012377333/article/details/47022699 从上面的几篇文章中,能够知道怎样使用Shell创建数据库.使用Shell创建 ...

  7. 【SQL Server数据迁移】把csv文件中的数据导入SQL Server的方法

    [sql] view plaincopy --1.修改系统参数 --修改高级参数 sp_configure 'show advanced options',1 go --允许即席分布式查询 sp_co ...

  8. CSV文件导出2

    public void exportCSVFile( HttpServletResponse response, ResultSet rs,String fileName,String headers ...

  9. csv文件导出

    参考博客:http://www.cnblogs.com/mingforyou/p/4103132.html 导入jar包javacsv.jar 链接:http://pan.baidu.com/s/1i ...

随机推荐

  1. Java垃圾回收机制和内存分配

    收集算法是内存回收的方法论,垃圾收集器是内存回收的具体实现 自动内存管理解决的是:给对象分配内存 以及 回收分配给对象的内存 为什么我们要了解学习 GC 与内存分配呢? 在 JVM 自动内存管理机制的 ...

  2. Varnish,Nginx搭建缓存服务器

    Varnish,Nginx搭建缓存服务器 一. varnish 1.安装pcre库,兼容正则表达式 # tar -zxvf pcre-8.10.tar.gz # cd pcre-8.10 # ./co ...

  3. BFC以及margin的深入探究

    BFC(Block Formatting Context) 块级格式化上下文,它是指一个独立的块级渲染区域,只有block-level Box参与,该区域拥有一套渲染规则来约束块级盒子的布局,且与区域 ...

  4. 转:Ubuntu下用Sublime输入中文

    最近用上ubuntu跑theano,碰到的一个问题就是用sublime编辑代码的时候无法输入中文. 读代码经常要写注释不能用中文是在是麻烦. 曾经考虑过使用别的文本编辑器,但是sublime的用户界面 ...

  5. linux rar安装

    1.wget http://www.rarsoft.com/rar_CN/rarlinux-3.9.3.tar.gz 2.tar 3.make && make install; 4.需 ...

  6. 8.Redis 数据备份与恢复

    转自:http://www.runoob.com/redis/redis-tutorial.html Redis SAVE 命令用于创建当前数据库的备份. 语法 redis Save 命令基本语法如下 ...

  7. 5.Redis 发布订阅

    转自:http://www.runoob.com/redis/redis-tutorial.html Redis 发布订阅(pub/sub)是一种消息通信模式:发送者(pub)发送消息,订阅者(sub ...

  8. Ryu控制器学习

    Ryu 在Mininet环境下实现Ryu为控制器控制ARP报文的实验中学习了Ryu相关的知识,记录如下 官方文档:http://ryu.readthedocs.io/en/latest/getting ...

  9. spring的传播行为和隔离级别

    7个传播行为,4个隔离级别(转自 http://www.blogjava.net/freeman1984/archive/2010/04/28/319595.html) Spring事务的传播行为和隔 ...

  10. mysql主从错误180301

    Fatal error: The slave I/O thread stops because master and slave have equal MySQL server ids; these ...