python中的编码与解码的区别:
我们提供的服务有:网站制作、成都网站建设、微信公众号开发、网站优化、网站认证、金坛ssl等。为1000+企事业单位解决了网站和推广的问题。提供周到的售前咨询和贴心的售后服务,是有科学管理、有技术的金坛网站制作公司
编码 / encode:将 Unicode 字符串转换为特定编码格式对应的字节码的过程
解码 / decode:将特定编码格式的字节码转换为对应的 Unicode 字符串的过程
示例:
In [43]: '美丽人生'.encode('gbk') Out[43]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa' In [44]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa'.decode('gbk') Out[44]: '美丽人生' In [45]: '美丽人生'.encode('utf-8') Out[45]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f' In [46]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f'.decode('utf-8') Out[46]: '美丽人生' In [47]: b'\xc3\xc0\xc0\xf6\xc8\xcb\xc9\xfa'.decode('gbk').encode('utf-8') Out[47]: b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f'
上面这种以 b 开头的就是字节码,一个斜杠就是一个字节。可见,一个常用汉字用 GBK 格式编码后占 2 个字节,用 UTF-8 格式编码后占 3 个字节。因为存储或传输时,也用 UTF-8 编码,所以一个汉字占的空间就是 3 个字节。
字符串长度和字节码长度:
In [61]: len('美丽人生') Out[61]: 4 In [62]: len(b'\xe7\xbe\x8e\xe4\xb8\xbd\xe4\xba\xba\xe7\x94\x9f') Out[62]: 12
当前文章:创新互联Python教程:python编码和解码区别是什么?
网页URL:http://www.shufengxianlan.com/qtweb/news44/551594.html
网站建设、网络推广公司-创新互联,是专注品牌与效果的网站制作,网络营销seo公司;服务项目有等
声明:本网站发布的内容(图片、视频和文字)以用户投稿、用户转载内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。文章观点不代表本网站立场,如需处理请联系客服。电话:028-86922220;邮箱:631063699@qq.com。内容未经允许不得转载,或转载时需注明来源: 创新互联