导语:
本文主要介绍了关于python开发中的编码方式如何对比使用?的相关知识,希望可以帮到处于编程学习途中的小伙伴
编码方式的历史大致为
ASCII ->gb2312->unicode->utf-8,期间具体详细信息
有兴趣的可以做一些查询。因为这样的过渡,我们需要有选择性地选择和使用同一个模块的不同用途。因此,这就引出了我们今天的话题,如何比较使用这些已有的编码。
来个编码解码的小例子先,记住中文可以进行
GBK和utf-8编码,在GBk一个中文字符对应两个字节,在utf-8一个中文字符对应三个字节,中文不能进行ASCII编码。
>>> '爬森'.encode('GBK')
b'\xc1\xf5\xc8\xf3\xc9\xad'
>>> '爬森'.encode('ascii')
Traceback (most recent call last):
File "<stdin>", line 1, in <module>
UnicodeEncodeError: 'ascii' codec can't encode characters in position 0-2: ordinal not in range(128)
>>> 'Runsen'.encode('ascii')
b'Runsen'
>>> "爬森".encode('utf-8')
b'\xe5\x88\x98\xe6\xb6\xa6\xe6\xa3\xae'
>>> '爬森'.encode('GBK').decode('GBK')
'爬森'
>>> '爬森'.encode('GBK').decode('utf-8')
UnicodeDecodeError: 'utf-8' codec can't decode byte 0xc1 in position 0: invalid start byte
如果编码解码格式不一致可能会出现乱码,
encode表示编码,decode表示解码,
这样大家在选择的时候就可以有一个清晰的思路。如果你想了解更多信息,请访问
即可。
本文为原创文章,版权归知行编程网所有,欢迎分享本文,转载请保留出处!
你可能也喜欢
- ♥ 如何编写python模块09/07
- ♥ python中相似函数的使用10/06
- ♥ Python itemgetter函数实现字典排序12/07
- ♥ 如何在python中实例化一个对象01/02
- ♥ python如何生成表单09/09
- ♥ python TestCase测试用例的使用方法12/04
内容反馈