二维码开源库ZBar-实现中文解码
中文乱码
上篇《ZBar-windows下编译和使用》已经成功解析了条形码,但目标是二维码,经测试二维码中文会出现乱码。
下图二维码的内容是“http123测试456”,解析后的内容为“http123娴嬭瘯456”
搜索了一下关键词,解决方案如下http://blog.csdn.net/zizi7/article/details/51880129
修改文件 zbar/qrcode/qrdectxt.c:
latin1_cd=iconv_open("GB18030","UTF-8");
/*But this one is often used, as well.*/
sjis_cd=iconv_open("GB2312","UTF-8");
/*This is a trivial conversion just to check validity without extra code.*/
utf8_cd=iconv_open("UTF-8","UTF-8");
...
enc_list[]=sjis_cd;
enc_list[]=latin1_cd;
enc_list[]=utf8_cd;
重新编译运行后,正确输出“http123测试456”
自己实现中文解码
ZBar解析后的字符原始输出是UTF-8格式,然后使用了iconv将其转换为相应的字符编码,但最终目标是移植到STM32F4上,如果要直接输出中文编码,有几种方案:
1. 把iconv移植到STM32F4上
2. 自己实现UTF8-8转中文编码
3. 把编码工作交给上位机
字符集和编码格式
搜索了一下字符编码规则,觉得方案2比方案1,3更容易实现。这里先简单介绍下与本文相关的字符集和编码格式。
1. Unicode
Unicode是字符集,也叫万国码,顾名思义就是包含所有国家的文字。
2. GB18030
GB18030是中文字符集,可以认为是Unicode的一个子集,还有其他GBXXXXX的中文字符集,他们的关系简单来说就是包含的中文字符个数不一样。简单起见,这里只是使用2个字节的GB18030,一共20902个汉字,也基本覆盖常见的汉字了。书读得少,4个字节的汉字也没认识几个。
3. UTF-8
UTF-8是Unicode字符集的一种编码格式,还有其他UTF-16,UTF-32,ZBar使用了 UTF-8。
UTF-8最大的一个特点,就是它是一种变长的编码方式。它可以使用1~6个字节表示一个符号,根据不同的符号而变化字节长度。
UTF-8的编码规则很简单,只有二条:
1)对于单字节的符号,字节的第一位设为0,后面7位为这个符号的unicode码。因此对于英语字母,UTF-8编码和ASCII码是相同的。
2)对于n字节的符号(n>1),第一个字节的前n位都设为1,第n+1位设为0,后面字节的前两位一律设为10。剩下的没有提及的二进制位,全部为这个符号的unicode码。
(具体例子可以参考http://blog.csdn.net/xiaolei1021/article/details/52093706)
下表总结了编码规则,字母x表示可用编码的位。
4. GB18030,Unicode,UTF-8的关系
UTF-8转GB18030实现
了解相关字符集和编码格式,可以开始写转换代码了。
1. 需要一个GB18030字符集,其实就是一个数组,实现代码如下(VS下编译)
调用UnicodeToGB18030Table函数生成一个GB18030字符集数组。
char* UnicodeToGB18030String(const wchar_t* unicode_str)
{
UINT code_page = ; //GB2312 :936 GB18030: 54936
int len=WideCharToMultiByte(code_page,,unicode_str,-,NULL,,NULL,NULL);
char* buf=new char[len+];
WideCharToMultiByte(code_page,,unicode_str,-,buf,len,NULL,NULL);
buf[len]=;
return buf;
}
int UnicodeToGB18030Table(void)
{
FILE *table;
wchar_t unicode[]={0x4E00,};
char* gb18030;
int cnt=;
table = fopen("unicode_to_gb18030_table.c","w");
if(table == NULL)
{
printf("can not open unicode_to_gb18030_table.c\n");
system("pause");
exit();
}
fprintf(table, "%s", "const char unicode_to_gb18030_table1[] = {\n");
for(unicode[]=0x4E00; unicode[]<=0x9FA5; unicode[]++)
{
gb18030 = UnicodeToGB18030String(unicode); if(unicode[]==0x9FA5)
{
fprintf(table, "0x%X,0x%X ", (UINT8)gb18030[],(UINT8)gb18030[]);
}
else
{
fprintf(table, "0x%X,0x%X, ", (UINT8)gb18030[],(UINT8)gb18030[]);
} cnt ++;
if(cnt == )
{
cnt = ;
fprintf(table, "\n");
}
} fprintf(table, "\n};");
fclose(table);
}
2. 通过查表,将UTF-8转为GB18030
int zbar_utf8_to_gb18030 (uint8_t* utf8_code, uint32_t utf8_len, uint8_t* gb18030)
{
uint8_t utf8_bytes[];//该数组最大为6个字节,但这里只考虑3个字节的中文编码
uint32_t i = , j = ;
uint16_t unicode_value;
uint8_t* unicode = gb18030; for(i=; i< utf8_len; i+=) {
utf8_bytes[] = utf8_code[i+] & 0x0F;
utf8_bytes[] = utf8_code[i+] & 0x3F;
utf8_bytes[] = utf8_code[i+] & 0x3F; unicode[j] = (utf8_bytes[] >> ) | ((utf8_bytes[]) << );
unicode[j+] = utf8_bytes[] | ((utf8_bytes[] & 0x03) << );
unicode_value = (unicode[j]<<) + unicode[j+];
if(unicode_value>=0x4E00){
gb18030[j] = unicode_to_gb18030_table1[(unicode_value-0x4E00)*];
gb18030[j+] = unicode_to_gb18030_table1[(unicode_value-0x4E00)* + ];
}
j += ;
}
return ;
}
中文字符集和编码转码函数有了,下一步就是替换ZBar源码的编码转换部分。
删掉zbar/qrcode/qrdectxt.c 中iconv相关的代码,将zbar_utf8_to_gb18030函数加入
qr_code_data_list_extract_text函数中:
int qr_code_data_list_extract_text(const qr_code_data_list *_qrlist,
zbar_image_scanner_t *iscn,
zbar_image_t *img)
{
....
case QR_MODE_BYTE:{
int gb18030_cnt = zbar_utf8_to_gb18030(entry->payload.data.buf, entry->payload.data.len, sa_text+sa_ntext);
sa_ntext += gb18030_cnt;
}
break;
....
}
重新编译运行后
正确输出“http123测试456”
坐等下班,回家过年...................
二维码开源库ZBar-实现中文解码的更多相关文章
- 二维码开源库zbar、zxing使用心得
首先说明我的测试场景是“识别打印在纸上的二维码”,在扫描结果中寻找二维码并进行识别,而不是直接让摄像头对着二维码扫描. zbar和zxing用的都是自己从github上clone的c++源码/接口编译 ...
- 二维码开源库ZBar-吐槽篇
前不久在网上看到一篇文章<QR-Decoder-OV5640 二维码识别> ,是某开发板的教程.记得对应的开发板以前购买过,当初只是为了看OV5640的JPG的输出效果,结果由于公司奇葩的 ...
- 二维码开源库ZBar-MDK STM32F429移植
前两篇文章已经实现ZBar在Windows平台下的编译和使用,本文将介绍如何把ZBar移植到STM32F429,IDE使用MDK. 1. MDK工程设置 (1)不勾选Use MicroLIB ,使用I ...
- 二维码开源库ZBar-windows下编译和使用
源码 下载最新Zbar源码(http://zbar.sourceforge.net/),网站的WIKI是空白的,所以只能在源码包里找使用说明了,很遗憾Windows下怎么编译没说明,只是说明了Wind ...
- C++二维码相关库编译
一.瞎想 坐在地铁上闲来无聊,突然想到了二维码,顺手就百度了下相关的资料,目前C++二维码相关的库不多,也就zbar(开源中国上下了半天也没下载下来).zxing,不过这两个库据说都是解析二维码的,不 ...
- Android二维码开源项目zxing用例简化和生成二维码、条形码
上一篇讲到:Android二维码开源项目zxing编译,编译出来后有一个自带的測试程序:CaptureActivity比較复杂,我仅仅要是把一些不用的东西去掉,用看起来更方便,二维码和条形码的流行性自 ...
- 个性二维码开源专题<替换元素点>
基础方法:ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // Fo ...
- 个性二维码开源专题<替换定位点>
基础方法: ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // F ...
- 个性二维码开源专题<液化/圆角/效果>
基础方法: ChangeFillShape //修改填充形状 ChangeFillShape(...) // 摘要: // 修改填充形状 // // 参数: // g: // 图形画板 // // F ...
随机推荐
- HTML5 Canvas 数据持久化存储之属性列表
属性列表想必大家都不会陌生,正常用 HTML5 来做的属性列表大概就是用下拉菜单之类的,而且很多情况下,下拉列表还不够好看,怎么办?我试着用 HT for Web 来实现属性栏点击按钮弹出多功能选框, ...
- Sql Server——约束
约束是什么: 每个人都在网站或者APP上注册过账号,在注册账号时会限制用户名.密码等格式,如果格式不对就不能注册.在数据库中我们可以通过约束来进行限制,超过约束范围的数据就不能写入. 约束的种类: 主 ...
- HDU 2063 过山车(模板—— 二分图最大匹配问题)
题目链接: http://acm.hdu.edu.cn/showproblem.php?pid=2063 解题思路: 二分图最大匹配模板题. AC代码: #include<stdio.h> ...
- ASP.NET core1.0 EF MYSQL搭建中碰到几个问题记录
1.No executable found matching command "dotnet-ef" 看了网上各种办法都没用,最后选择"个人用户账户"创建项 ...
- 织梦DedeCms获取当前页面URL地址的调用方法
织梦内容页如何调用当前页面url?相信很多对织梦感兴趣的朋友都会去考虑这个问题:在文章内容中加入本文链接,除了 保护自己版权外还可以增加网站的外链收录.网上这方面的帖子一搜一大堆,但多数都只能调用相对 ...
- 4种常用扒站工具(webzip、ha_TeleportPro、Offline Explorer、wget)
许多开始做lead,EMU的新手,需要一个英文网站,找人定制费用太贵自己又不会技术的话,可以通过扒站来获得英文站,今天给大家介绍几种扒站工具: 1.HA_TeleportPro: Teleport P ...
- 使用npm安装依赖,尽量别使用cnpm,会漏掉很多依赖的
使用npm安装依赖,尽量别使用cnpm,会漏掉很多依赖的
- .32-浅析webpack源码之doResolve事件流(4)
流程图如下: 重回DescriptionFilePlugin 上一节最后进入relative事件流,注入地点如下: // relative plugins.push(new DescriptionFi ...
- cuda纹理内存的使用
CUDA纹理内存的访问速度比全局内存要快,因此处理图像数据时,使用纹理内存是一个提升性能的好方法. 贴一段自己写的简单的实现两幅图像加权和的代码,使用纹理内存实现. 输入:两幅图 lena, moon ...
- 【开发技术】视频URL采集
http://www.joyplus.tv/joypluscms 志精