python decode unicode encode

字符串在Python内部的表示是unicode编码，因此，在做编码转换时，通常需要以unicode作为中间编码，即先将其他编码的字符串解码（decode）成unicode，再从unicode编码（encode）成另一种编码。

代码中字符串的默认编码与代码文件本身的编码一致，以下是不一致的两种:

1. s = u'你好'

该字符串的编码就被指定为unicode了，即python的内部编码，而与代码文件本身的编码(查看默认编码：import sys print('hello',sys.getdefaultencoding()) ascii 。设置默认编码：import sys reload(sys) sys.setdefaultencoding('utf-8')))无关。因此，对于这种情况做编码转换，只需要直接使用encode方法将其转换成指定编码即可.

2. # -*- coding: utf-8 -*-

s = ‘你好’

此时为utf-8编码，ascii编码不能显示汉字

isinstance(s, unicode) #用来判断是否为unicode ,是返回True，不是返回False

unicode(str,'gb2312')与str.decode('gb2312')是一样的，都是将gb2312编码的str转为unicode编码

使用str.__class__可以查看str的编码形式

原理说了半天，最后来个包治百病的吧：）

#!/usr/bin/env python
#coding=utf-8
s="中文"

if isinstance(s, unicode):
#s=u"中文"
print s.encode('gb2312')
else:
#s="中文"
print s.decode('utf-8').encode('gb2312')

语音模块代码：

# -*- coding: utf-8 -*-import

import sys

print('hello',sys.getdefaultencoding())

def xfs_frame_info(words):

    #decode utf-8 to python internal unicode coding

    isinstance(words,unicode)

    wordu = words.decode('utf-8')

    #encode python unicode to gbk

    data = wordu.encode('gbk')

    length = len(data) + 2

    frame_info = bytearray(5)

    frame_info[0] = 0xfd

    frame_info[1] = (length >> 8)

    frame_info[2] = (length & 0x00ff)

    frame_info[3] = 0x01

    frame_info[4] = 0x01

    buf = frame_info + data

    print("buf:",buf)

    return buf

if __name__ == "__main__":

    print("hello world")

    words1= u'你好'

    #encodetype = isinstance(words1,unicode)

    #print("encodetype",encodetype)

    print("origin unicode", words1)

    words= words1.encode('utf-8')

    print("utf-8 encoded", words)

    a = xfs_frame_info(words)

    print('a',a)

if __name__ == "__main__":

    print("hello world")

    words1= '你好'

    print("oringe utf-8 encode:",words1)

    encodetype = isinstance(words1,unicode)

    wordu = words1.decode('utf-8')

    print("unicode from utf-8 decode:",wordu)

    #encodetype = isinstance(words1,utf-8)

    #encodetype = isinstance(words1,'ascii')

    #print("encodetype",encodetype)

    #print("origin unicode", words1)

    word_utf8 = wordu.encode('utf-8')

    #encodetype2 = isinstance(words,utf8)

    #print("encodetype2",encodetype2)

    print("utf-8 encoded",word_utf8)

    a = xfs_frame_info(word_utf8)

    print('a',a)

你好前不加u''时，要多一步decode为unicode

python decode unicode encode的更多相关文章

Python decode与encode
字符串在Python内部的表示是unicode编码(8-bit string),因此,在做编码转换时,通常需要以unicode作为中间编码,即先将其他编码的字符串解码(decode)成unicod ...
关于python decode()和 encode()
1.先收集一下这几天看到的关于decode()解码和encode()编码的用法 bytes和str是字节包和字符串,python3中会区分bytes和str,不会混用这两个.字符串可以编码成字节包,而 ...
python decode和encode
摘抄: 字符串在Python内部的表示是Unicode编码,因此,在做编码转换时,通常需要以unicode作为中间编码,即先将其他编码的字符解码(decode)成unicode,再从unicode编码 ...
python encode decode unicode区别及用法
decode 解码 encode 转码 unicode是一种编码,具体可以百度搜 # coding: UTF-8 u = u'汉' print repr(u) # u'\u6c49' s = u.en ...
Python字符串的encode与decode研究心得乱码问题解决方法
为什么Python使用过程中会出现各式各样的乱码问题,明明是中文字符却显示成“\xe4\xb8\xad\xe6\x96\x87”的形式? 为什么会报错“UnicodeEncodeError: 'asc ...
python字符decode与encode的问题
同事在工作中遇到一个字符编码的问题:问题是:从mysql数据库中读出来的varchar类型数据在python是unicode类型的. 但他却对这个unicode字符进行了decode,因为他以为读出来 ...
Python字符串的encode与decode研究心得乱码问题解决方法
以下摘自:http://www.jb51.net/article/17560.htm 为什么Python使用过程中会出现各式各样的乱码问题,明明是中文字符却显示成“\xe4\xb8\xad\xe6\x ...
Python字符串的encode与decode研究心得——解决乱码问题
转~Python字符串的encode与decode研究心得——解决乱码问题为什么Python使用过程中会出现各式各样的乱码问题,明明是中文字符却显示成“/xe4/xb8/xad/xe6/x96/x8 ...
【Python】关于decode和encode
#-*-coding:utf-8 import sys ''' *首先要搞清楚,字符串在Python内部的表示是unicode编码,因此,在做编码转换时,通常需要以unicode作为中间编码, 即先将 ...

随机推荐

Java中的线程--线程中的工具
这主要想写一下Java中的jdk提供的一些线程中的工具, 一.semaphore信号灯 Semaphore可以维护当前访问自身的线程个数,并提供了同步机制,使用Semaphore可以控制同时访问资源的 ...
使Linux支持exFAT和NTFS格式的磁盘
Linux支持exFAT和NTFS Linux系统默认可以自动识别到fat32格式的盘,但fat32支持的文件不能大于4G,所以只能将移动硬盘和U盘格式化为NTFS和exFAT这两种格式的,对于U盘最 ...
mysql函数总结
MySQL函数 MySQL数据库提供了很多函数包括: 数学函数:字符串函数:日期和时间函数:条件判断函数:系统信息函数:加密函数:格式化函数: 一.数学函数数学函数主要用于处理数字,包括整型.浮点数 ...
包含min的栈
#include <iostream> #include <stack> using namespace std; void push(stack<int> &am ...
Android开发——ThreadLocal功能介绍
个静态的监听器对象,显然是无法接受的. 2. 使用实例 //首先定义一个ThreadLocal对象,选择泛型为Boolean类型 private ThreadLocal<Boolean> ...
mysql条件查询and or使用实例及优先级介绍
mysql and与or介绍 AND 和 OR 可在 WHERE 子语句中把两个或多个条件结合起来. 使用OR关键字时: 只要符合这几个查询条件的其中一个条件,这样的记录就会被查询出来. 如果不符合这 ...
【编程工具】Sublime Text3的安装和常用插件推荐
本人刚刚学习 HTML,曾经上网找过一些编写 HTML 的软件,但感觉都不太好,经过三挑四选下,最终我决定选择 Sublime Text3 这款软件来作为学习工具,上网找到了许多实用的插件,在这里给大 ...
redis介绍和安装和主从介绍（二）
redis正式安装过程安装依赖,下载解压,编译安装 yum install gcc-c++ tcl wget http://download.redis.io/releases/redis-4.0. ...
shell的if-else的基本用法
if 语句通过关系运算符判断表达式的真假来决定执行哪个分支.Shell 有三种 if ... else 语句: if ... fi 语句: if ... else ... fi 语句: if ... ...
Codeforces 547B. Mike and Feet[单调栈/队列]
这道题用单调递增的单调栈维护每个数能够覆盖的最大区间即可. 对于 1 2 3 4 5 4 3 2 1 6 这组样例, 1能够覆盖的最大区间是10,2能够覆盖的最大区间是7,以此类推,我们可以使用单 ...

python decode unicode encode

python decode unicode encode的更多相关文章

随机推荐

热门专题