Skip to content

Latest commit

 

History

History
41 lines (33 loc) · 1.93 KB

File metadata and controls

41 lines (33 loc) · 1.93 KB

Python 字符串知识点总结

1.编码

计算机内的字符都得转化为数字去表示 传统的ASCII编码只收录了大小写字母及常用标点符号,在内存中一个字符占用一个字节来存储。但是对于其他语言的字符 一个字节无法表示 所以为解决此问题 Unicode编码应运而生。Unicode字符常用2个字节表示 偏僻的字符会用4个字节来表示。为了避免浪费存储空间需要动态的调节字符占用的空间 所以UTF-8就是这种 英文字符用一个字节表示,中文常用3个字节表示,偏僻字符 用6个字节表示。

2.字符串编码转换

在内存中python一律用unicode表示,但是在存储的时候往往需要节省空间 需要转换成UTF-8格式,所以往往需要我们来告诉编辑器按那种方式去编码字符 一般 python脚本开头会有"# -- coding:utf-8 --" 这样的字样。就是用来告诉编辑器按utf-8格式去编码字符 python字符串提供了decode方法可以指定编码方式

'中国'.encode('utf-8') #从unicode编码按指定的编码方式编码成字节流
b'ABC'.decode('utf-8' ) #从字节流按指定编码方式进行编码成Unicode字符
ord('A') # 输出字符A的数字表示
ord('中')
chr(66) #输出此数字表示的字符 
'\u4e2d\u6587' #unicode 数字方式表示的字符串
中文

3.字符串的格式化

python 使用类似c的字符串格式方法 %d 整型 %s 字符串 %f 浮点类型 %x 十六进制 还可以调用字符串的format()方法

>>> print("%d" % 111)
111
>>> print("%2d" % 1)
 1
>>> print("%02d" % 1)
01
>>> print("%0.2f" % 1.2323)
1.23
>>> print("%x" % 255)
ff
>>> "中国,{0},我爱你{1:.2f}年!".format('你好',100.123)
'中国,你好,我爱你100.12年!'

4.字符串操作函数

查看字符串相关函数

Python帮助文档查看方法