golang初试:坑爷的
用Golang与perl脚本比较, 初想至多差一倍吧...结果可不是一般的坑爹, 简直就是坑爷了.
Perl脚本
#!/bin/bash
source /etc/profile;
function extractAndZip(){
_debug "$FUNCNAME,$@";
local logFile="${2}"
local gzipFile="${1}"
perl -ne 'if(m/([^ ]*) \- ([^ ]*) \[([^ ]*) [\+\-][0-9]{4}\] \"(\-|(([^ ]*) )?([^\?\;\% ]*)([\?\;\%]([^ ]*))?( ([^\"]*))?)\" ([^ ]*) ([^ ]*) \"([^\"]*)\" \"([^\"]*)\" \"([^\"]*)\" ([^ ]*) (\-|([^\-]+))/){printf("%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\001%s\n", ${1}, ${2}, ${3}, ${6}, ${7}, ${9}, ${11}, ${12}, ${13}, ${14}, ${15}, ${16}, ${17}*1000, ${19}*1000)}' ${logFile} | gzip > ${gzipFile};
}
extractAndZip "$@"
www-data@dc26:/data2/rsynclog/gotest$ time bash perl.sh result.gz 2014-06-17+yyexplorer+58.215.138.18+yyexplorer-access.log
/data/sa/profile_common: line 23: ulimit: open files: cannot modify limit: Operation not permitted
perl.sh: line 6: _debug: command not found
real 4m5.222s
user 5m54.630s
sys 0m9.720s
6分钟全部搞定...
golang代码:
package main
import (
"bufio"
"compress/gzip"
"fmt"
"os"
"regexp"
"strconv"
//"strings"
)
var recordRegExp = regexp.MustCompile(`([^ ]*) \- ([^ ]*) \[([^ ]*) [\+\-][0-9]{4}\] \"(\-|(([^ ]*) )?([^\?\;\% ]*)([\?\;\%]([^ ]*))?( ([^\"]*))?)\" ([^ ]*) ([^ ]*) \"([^\"]*)\" \"([^\"]*)\" \"([^\"]*)\" ([^ ]*) (\-|([^\-]+))`)
func toInt(str string) int {
val, err := strconv.Atoi(str)
if err != nil {
return val
}
return 0
}
func main() {
if len(os.Args) < 3 {
fmt.Println("Usage:", os.Args[0], "<out_zip_file>", "<in_txt_file1...>")
os.Exit(1)
}
outZipFile, err := os.Create(os.Args[1])
if err != nil {
fmt.Errorf("错误:%s\n", err.Error())
os.Exit(1)
}
defer outZipFile.Close()
inTxtFiles := make([]*os.File, len(os.Args)-2)
for _, path := range os.Args[2:] {
file, err := os.Open(path)
if err != nil {
fmt.Errorf("错误:%s\n", err.Error())
os.Exit(1)
}
defer file.Close()
inTxtFiles = append(inTxtFiles, file)
}
zipIo := gzip.NewWriter(outZipFile)
defer zipIo.Close()
out := bufio.NewWriter(zipIo)
for _, file := range inTxtFiles {
scan := bufio.NewScanner(file)
for scan.Scan() {
line := scan.Bytes()
items := recordRegExp.FindSubmatch(line)
out.Write(items[1])
out.Write([]byte("\t"))
out.Write(items[2])
out.Write([]byte("\t"))
out.Write(items[3])
out.Write([]byte("\t"))
out.Write(items[6])
out.Write([]byte("\t"))
out.Write(items[7])
out.Write([]byte("\t"))
out.Write(items[9])
out.Write([]byte("\t"))
out.Write(items[11])
out.Write([]byte("\t"))
out.Write(items[12])
out.Write([]byte("\t"))
out.Write(items[13])
out.Write([]byte("\t"))
out.Write(items[14])
out.Write([]byte("\t"))
out.Write(items[15])
out.Write([]byte("\t"))
out.Write(items[16])
out.Write([]byte("\t"))
out.Write([]byte(strconv.Itoa(toInt(string(items[17])) * 1000)))
out.Write([]byte("\t"))
out.Write([]byte(strconv.Itoa(toInt(string(items[19])) * 1000)))
out.Write([]byte("\n"))
}
out.Flush()
}
}
结果手工kill时:
16m才完成了3分之1左右...坑你爷了...
golang初试:坑爷的的更多相关文章
- 初生牛犊不怕虎 golang入坑系列
读前必读,下面所有内容都是来自这里. 放到这里的目的,就是为了比对一下,哪里的读者多.平心而论,同样的Markdown,博客园排版真心X看,怎么瞅怎么X看.(X := '难' || X :='耐' | ...
- golang的哪些坑爷事: package实践
在golang中package是个困惑的概念, 特别是package还可以与folder不同名, 委实让我恶心了一把. 关于golang的package的最佳实践: package is folder ...
- 入坑第二式 golang入坑系统
史前必读: 这是入坑系列的第二式,如果错过了第一式,可以去gitbook( https://andy-zhangtao.gitbooks.io/golang/content/ )点个回放,看个重播.因 ...
- 维多利亚的秘密 golang入坑系统
原文在gitbook,字字原创,版权没有,转载随意. 在写本文的前一天,2017维密在上海开始了. 为了纪念屌丝界的盛世,特为本节起名维多利亚的秘密.现在的社会,要想出名只有抓眼球.所以写份技术文章, ...
- 崩溃 golang入坑系列
早上(11.30)收到邮件,Vultr东京机房网络故障.当时搭建SS时,考虑到了机房故障.所以特意分出了日本和香港两条线路.但千算万算,忘记数据库还在东京机房中. 现在网络故障,SS服务器无法读取数据 ...
- jupyter notebook安装/代码补全/支持golang 踩坑记
安装(不要用root) 安装anaconda3,然后ln -s bin目录下的jupyter命令到/usr/bin目录下 生成密码备用 敲ipython进入交互终端 In [1]: from note ...
- 维多利亚的秘密 golang入坑系列
原文在gitbook,字字原创,版权没有,转载随意. 在写本文的前一天,2017维密在上海开始了. 为了纪念屌丝界的盛世,特为本节起名维多利亚的秘密.现在的社会,要想出名只有抓眼球.所以写份技术文章, ...
- 入坑第二式 golang入坑系列
史前必读: 这是入坑系列的第二式,如果错过了第一式,可以去gitbook( https://andy-zhangtao.gitbooks.io/golang/content/ )点个回放,看个重播.因 ...
- golang深坑记录
go深坑:1.gin.context.JSON,如果没有make数组时,数组返回为null,make后,数组为[]2.json.Number转int64类型 datatemp.(json.Number ...
随机推荐
- visio2007无法拖动
连按两下键盘上的 “Esc” 键
- Swift学习(三)类型推导&基本运算&分支&循环
一.Swift中类型推导&基本运算 Swift中类型推导 如果一个标识符在定义时有直接赋值,那么可以根据后面赋值的类型,来推导出前面标识符的类型,这样前面标识符的(:类型)可以省略 查看标识符 ...
- 操作笔记:linux下查看端口被占用
[root@iZ945sgm0ugZ /]# lsof -i:8080 COMMAND PID USER FD TYPE DEVICE SIZE/OFF NODE NAME java 1192 jet ...
- 全选Form > Grid 的所有行
在AX的Grid 按Ctrl+A,并不一定能选择到grid 的所有行,比如你要将当前grid的数据复制到Excel,你需要全部选择所有行. 但AX自身的数据缓存机制,数据量非常大的时候当前grid只装 ...
- 将windows系统装到USB存储设备
需求: 1)一般公司比较规范,计算机系统有严格的限制策略,如果自己不懂得如何更改或者没有权限更改,将极其不便. 2)计划在家里完成在公司未完成的事,甚至异地出差觉得携带笔记本不太方便,寻找更便携的设备 ...
- 对C语言中va_list,va_start,va_arg和va_end的一点理解
这几个函数和变量是针对可变参数函数的,什么是可变参数函数呢,最经典的莫过于printf和scanf,这两个函数的声明如下: int printf(const char *format, ...); i ...
- jQuery bind and unbind (绑定和解除)
测试:页面代码: <body> <input type="button" name="aaa" value="点击我"&g ...
- POJ C程序设计进阶 编程题#1:寻找下标
编程题#1:寻找下标 来源: POJ (Coursera声明:在POJ上完成的习题将不会计入Coursera的最后成绩.) 注意: 总时间限制: 1000ms 内存限制: 65536kB 描述 已知一 ...
- 导出数据库数据制成Excel和txt
引用ICSharpCode.SharpZipLib.dll 1.编写压缩和解压代码 using System; using System.Collections.Generic; using Syst ...
- ElasticSearch部署
安装jdk1.7 1.卸载Liunx自带的openjdk rpm -qa | grep jdk 查看当前的jdk版本 sudo yum -y remove java-1.7.0-openjdk-hea ...