Python中字符串与编码示例代码


Posted in Python onMay 20, 2019

在最新的Python 3版本中,字符串是以Unicode编码的,即Python的字符串支持多语言

编码和解码

 

字符串在内存中以Unicode表示,在操作字符串时,经常需要str和bytes互相转换
 

如果在网络上传输或保存到磁盘上,则从内存读到的数据就是str,要把str变为以字节为单位的bytes,称为编码
 

如果从网络或磁盘上读取字节流,则从网络或磁盘上读到的数据就是bytes,要把bytes变为str,称为解码
 

为避免乱码问题,应当始终坚持使用UTF-8编码对str和bytes进行转换

使用示例:

单个字符的编码

print(ord('A')) #输出:65,获取字符的整数表示
print(chr(66)) #输出:B,把编码转换为对应的字符

十六进制表示

print('中文') #输出:'中文',
print('\u4e2d\u6587') #输出:'中文','\u4e2d\u6587'和'中文'完全对等,如果知道字符的整数编码,还可以用十六进制这么写str

bytes类型的数据表示

x = b'ABC' #Python对bytes类型的数据用带b前缀的单引号或双引号表示,'ABC'和b'ABC'在显示上完全一样,但bytes的每个字符都只占用一个字节

编码

print('ABC'.encode('ascii')) #输出:b'ABC',以Unicode表示的str通过encode()方法可以编码为指定的bytes
print( '中文'.encode('utf-8')) #输出:b'\xe4\xb8\xad\xe6\x96\x87',
print( '中文'.encode('ascii')) #输出:报错,因为中文字符在ascii编码范围外,所以导致编码失败

解码

print(b'ABC'.decode('ascii')) #输出:'ABC'
print(b'\xe4\xb8\xad\xe6\x96\x87'.decode('ascii')) #输出:'中文'
print(b'\xe4\xb8\xad\xff'.decode('utf-8', errors='ignore')) #输出:'中',如果bytes中只有一小部分无效的字节,可以传入errors='ignore'忽略错误的字节

计算长度

#len(a)函数返回a的长度,如果a是字符串则返回字符数,如果a是字节表示则返回字节数
print(len('中文')) #输出:2,共2个字符
print(len('ABC')) #输出:3,共3个字符
print(len(b'ABC')) #输出:3,共是3个字节
print(len(b'\xe4\xb8\xad\xe6\x96\x87')) #输出:6,共是6个字节
print(len('中文'.encode('utf-8'))) #输出:6, 1个中文字符经过UTF-8编码后通常会占用3个字节,因此两个汉字的字节数是6

源码文件开头与编码

#!/usr/bin/env python3    告诉Linux/OS X系统,这是一个Python可执行程序,Windows系统会忽略这个注释
# -*- coding: utf-8 -*-   告诉Python解释器,按照UTF-8编码读取源代码,否则在源代码中写的中文输出可能会有乱码

#注意:告诉编译器使用UTF-8编码并不意味着.py文件就是UTF-8编码的,必须并且要确保.py文件用UTF-8 without BOM编码保存,才可确保文件中的中文正常显示

总结

以上所述是小编给大家介绍的Python中字符串与编码示例代码,希望对大家有所帮助,如果大家有任何疑问欢迎给我留言,小编会及时回复大家的!

Python 相关文章推荐
Python的包管理器pip更换软件源的方法详解
Jun 20 Python
浅谈pandas中DataFrame关于显示值省略的解决方法
Apr 08 Python
一个简单的python爬虫程序 爬取豆瓣热度Top100以内的电影信息
Apr 17 Python
Python采集代理ip并判断是否可用和定时更新的方法
May 07 Python
Pandas 数据处理,数据清洗详解
Jul 10 Python
Python+OpenCV图片局部区域像素值处理详解
Jan 23 Python
Django利用cookie保存用户登录信息的简单实现方法
May 27 Python
python实现鸢尾花三种聚类算法(K-means,AGNES,DBScan)
Jun 27 Python
Python日志无延迟实时写入的示例
Jul 11 Python
Python检测端口IP字符串是否合法
Jun 05 Python
Pytorch上下采样函数--interpolate用法
Jul 07 Python
python实现web邮箱扫描的示例(附源码)
Mar 30 Python
python实现统计文本中单词出现的频率详解
May 20 #Python
详解Python字符串切片
May 20 #Python
Django中ORM外键和表的关系详解
May 20 #Python
利用Django模版生成树状结构实例代码
May 19 #Python
使用Python3内置文档高效学习以及官方中文文档
May 19 #Python
python反编译学习之字节码详解
May 19 #Python
python从入门到精通 windows安装python图文教程
May 18 #Python
You might like
phpmyadmin操作流程
2006/10/09 PHP
phpmyadmin显示utf8_general_ci中文乱码的问题终级篇
2013/04/08 PHP
CI框架教程之优化验证码机制详解【验证码辅助函数】
2019/04/16 PHP
thinkphp5 + ajax 使用formdata提交数据(包括文件上传) 后台返回json完整实例
2020/03/02 PHP
PHP反射基础知识回顾
2020/09/10 PHP
js 方法实现返回多个数据的代码
2009/04/30 Javascript
jquery validator 插件增加日期比较方法
2010/02/21 Javascript
14款NodeJS Web框架推荐
2014/07/11 NodeJs
5个JavaScript经典面试题
2014/10/13 Javascript
Javascript基础教程之argument 详解
2015/01/18 Javascript
JavaScript将数组转换成CSV格式的方法
2015/03/19 Javascript
无需 Flash 使用 jQuery 复制文字到剪贴板
2016/04/26 Javascript
Sea.JS知识总结
2016/05/05 Javascript
JavaScript中捕获/阻止捕获、冒泡/阻止冒泡方法
2016/12/07 Javascript
微信小程序 页面跳转传值实现代码
2017/07/27 Javascript
jQuery UI 实例讲解 - 日期选择器(Datepicker)
2017/09/18 jQuery
vue实现侧边栏导航效果
2019/10/21 Javascript
javascript代码实现简易计算器
2021/01/25 Javascript
[01:03:00]DOTA2上海特级锦标赛A组败者赛 EHOME VS CDEC第一局
2016/02/25 DOTA
Python入门教程之if语句的用法
2015/05/14 Python
python脚本设置系统时间的两种方法
2016/02/21 Python
Python编程中归并排序算法的实现步骤详解
2016/05/04 Python
Python获取当前页面内所有链接的四种方法对比分析
2017/08/19 Python
python用opencv批量截取图像指定区域的方法
2019/01/24 Python
如何使用PyCharm将代码上传到GitHub上(图文详解)
2020/04/27 Python
matplotlib之pyplot模块之标题(title()和suptitle())
2021/02/22 Python
印度最大的时尚购物网站:Myntra
2018/09/13 全球购物
Delphi CS笔试题
2014/01/04 面试题
汽车技术服务与营销专业推荐信
2013/11/29 职场文书
激情洋溢的毕业生就业求职信
2014/03/15 职场文书
公司请假条范文
2014/04/11 职场文书
学生检讨书怎么写
2014/10/09 职场文书
终止劳动合同证明书样本
2014/11/19 职场文书
常务副总经理岗位职责
2015/02/02 职场文书
二手房购房意向书
2015/05/09 职场文书
《艾尔登法环》发布最新「战技」宣传片
2022/04/03 其他游戏