Python从0到100(九):Python字符串介绍及使用

一、字符串的定义
1.什么是字符串
字符串是一种表示文本数据的类型。所谓字符串,就是由零个或多个字符组成的有限序列,一般记为:
使用单引号:
‘a’ 、‘123’
使用双引号:
“a”、“123”
使用三引号:
“”"
Hello
“”"
2.转义字符
看下面的代码:
>>>'let's go! go'
  File "<input>", line 1
    'let's go! go'
         ^
SyntaxError: invalid syntax
对于单引号或者双引号这些特殊的符号,我们可以对他们进行转义。例如,对字符串中的单引号进行转义:
>>>'let\'s go! go'
"let's go! go"

在Python程序中,如果我们把单个或多个字符用单引号或者双引号包围起来,就可以表示一个字符串。字符串中的字符可以是特殊符号、英文字母、中文字符、日文的平假名或片假名、希腊字母、Emoji字符等。
# @Time : 2024/2/29 9:18
# @Author : 是Dream呀
# @File : Python 1.py
s1 = 'hello, world!'
s2 = "你好,世界!"
print(s1, s2)
# 以三个双引号或单引号开头的字符串可以折行
s3 = '''
hello, 
world!
'''
print(s3, end='')

print函数中的end=''表示输出后不换行,即将默认的结束符\n(换行符)更换为''(空字符)。
二、字符串的运算
Python为字符串类型提供了非常丰富的运算符,我们可以使用+运算符来实现字符串的拼接,可以使用*运算符来重复一个字符串的内容,可以使用in和not in来判断一个字符串是否包含另外一个字符串,我们也可以用[]和[:]运算符从字符串取出某个字符或某些字符。
1.拼接和重复
下面的例子演示了使用+和*运算符来实现字符串的拼接和重复操作。
s1 = 'hello' + ' ' + 'world'
print(s1)    # hello world
s2 = '!' * 3
print(s2)    # !!!
s1 += s2     # s1 = s1 + s2
print(s1)    # hello world!!!
s1 *= 2      # s1 = s1 * 2
print(s1)    # hello world!!!hello world!!!
用*实现字符串的重复是非常有意思的一个运算符,在很多编程语言中,要表示一个有10个a的字符串,你只能写成"aaaaaaaaaa",但是在Python中,你可以写成'a' * 10。你可能觉得"aaaaaaaaaa"这种写法也没有什么不方便的,那么想一想,如果字符a要重复100次或者1000次又会如何呢?
2.比较运算
对于两个字符串类型的变量,可以直接使用比较运算符比较两个字符串的相等性或大小。需要说明的是,因为字符串在计算机内存中也是以二进制形式存在的,那么字符串的大小比较比的是每个字符对应的编码的大小。例如A的编码是65, 而a的编码是97,所以'A' < 'a'的结果相当于就是65 < 97的结果,很显然是True;而'boy' < 'bad',因为第一个字符都是'b'比不出大小,所以实际比较的是第二个字符的大小,显然'o' < 'a'的结果是False,所以'boy' < 'bad'的结果也是False。
s1 = 'a whole new world'
s2 = 'hello world'
print(s1 == s2, s1 < s2)      # False True
print(s2 == 'hello world')    # True
print(s2 == 'Hello world')    # False
print(s2 != 'Hello world')    # True
需要强调一下的是,字符串的比较运算比较的是字符串的内容,Python中还有一个is运算符(身份运算符),如果用is来比较两个字符串,它比较的是两个变量对应的字符串对象的内存地址(不理解先跳过),简单的说就是两个变量是否对应内存中的同一个字符串。看看下面的代码就比较清楚is运算符的作用了。
s1 = 'hello world'
s2 = 'hello world'
s3 = s2
# 比较字符串的内容
print(s1 == s2, s2 == s3)    # True True
# 比较字符串的内存地址
print(s1 is s2, s2 is s3)    # False True
3.成员运算
Python中可以用in和not in判断一个字符串中是否存在另外一个字符或字符串,in和not in运算通常称为成员运算,会产生布尔值True或False,代码如下所示。
s1 = 'hello, world'
print('wo' in s1)    # True
s2 = 'goodbye'
print(s2 in s1)      # False
4.获取字符串长度
获取字符串长度没有直接的运算符,而是使用内置函数len,我们在上节课的提到过这个内置函数,代码如下所示。
s = 'hello, world'
print(len(s))                   # 12
print(len('goodbye, world'))    # 14
5.索引和切片
如果希望从字符串中取出某个字符,我们可以对字符串进行索引运算,运算符是[n],其中n是一个整数,假设字符串的长度为N,那么n可以是从0到N-1的整数,其中0是字符串中第一个字符的索引,而N-1是字符串中最后一个字符的索引,通常称之为正向索引;在Python中,字符串的索引也可以是从-1到-N的整数,其中-1是最后一个字符的索引,而-N则是第一个字符的索引,通常称之为负向索引。注意,因为字符串是不可变类型,所以不能通过索引运算修改字符串中的字符。
s = 'abc123456'
N = len(s)
# 获取第一个字符
print(s[0], s[-N])    # a a
# 获取最后一个字符
print(s[N-1], s[-1])  # 6 6
# 获取索引为2或-7的字符
print(s[2], s[-7])    # c c
# 获取索引为5和-4的字符
print(s[5], s[-4])    # 3 3
在进行索引操作时,如果索引越界(正向索引不在0到N-1范围,负向索引不在-1到-N范围),会引发IndexError异常,错误提示信息为:string index out of range(字符串索引超出范围)。
具体例子:
s = 'abc123456'
# i=2, j=5, k=1的正向切片操作
print(s[2:5])       # c12
# i=-7, j=-4, k=1的正向切片操作
print(s[-7:-4])     # c12
# i=2, j=9, k=1的正向切片操作
print(s[2:])        # c123456
# i=-7, j=9, k=1的正向切片操作
print(s[-7:])       # c123456
# i=2, j=9, k=2的正向切片操作
print(s[2::2])      # c246
# i=-7, j=9, k=2的正向切片操作
print(s[-7::2])     # c246
# i=0, j=9, k=2的正向切片操作
print(s[::2])       # ac246
# i=1, j=-1, k=2的正向切片操作
print(s[1:-1:2])    # b135
# i=7, j=1, k=-1的负向切片操作
print(s[7:1:-1])    # 54321c
# i=-2, j=-8, k=-1的负向切片操作
print(s[-2:-8:-1])  # 54321c
# i=7, j=-10, k=-1的负向切片操作
print(s[7::-1])     # 54321cba
# i=-1, j=1, k=-1的负向切片操作
print(s[:1:-1])     # 654321c
# i=0, j=9, k=1的正向切片
print(s[:])         # abc123456
# i=0, j=9, k=2的正向切片
print(s[::2])       # ac246
# i=-1, j=-10, k=-1的负向切片
print(s[::-1])      # 654321cba
# i=-1, j=-10, k=-2的负向切片
print(s[::-2])      # 642ca
6.循环遍历每个字符
如果希望从字符串中取出每个字符,可以使用for循环对字符串进行遍历,有两种方式。
方式一:
s1 = 'hello'
for index in range(len(s1)):
    print(s1[index])

方式二:
s1 = 'hello'
for ch in s1:
    print(ch)

三、字符串的方法
在Python中,我们可以通过字符串类型自带的方法对字符串进行操作和处理,对于一个字符串类型的变量,我们可以用变量名.方法名()的方式来调用它的方法。所谓方法其实就是跟某个类型的变量绑定的函数,后面我们讲面向对象编程的时候还会对这一概念详加说明。
1.大小写相关操作
下面的代码演示了和字符串大小写变换相关的方法。
# @Time : 2024/2/29 9:18
# @Author : 是Dream呀
# @File : Python 1.py
s1 = 'hello, world!'
# 使用capitalize方法获得字符串首字母大写后的字符串
print(s1.capitalize())   
# 使用title方法获得字符串每个单词首字母大写后的字符串
print(s1.title())      
# 使用upper方法获得字符串大写后的字符串
print(s1.upper())      
s2 = 'GOODBYE'
# 使用lower方法获得字符串小写后的字符串
print(s2.lower())       

2.查找操作
如果想在一个字符串中从前向后查找有没有另外一个字符串,可以使用字符串的find或index方法。
s = 'hello, world!'
# find方法从字符串中查找另一个字符串所在的位置
# 找到了返回字符串中另一个字符串首字符的索引
print(s.find('or'))        # 8
# 找不到返回-1
print(s.find('shit'))      # -1
# index方法与find方法类似
# 找到了返回字符串中另一个字符串首字符的索引
print(s.index('or'))       # 8
# 找不到引发异常
print(s.index('shit'))     # ValueError: substring not found
在使用find和index方法时还可以通过方法的参数来指定查找的范围,也就是查找不必从索引为0的位置开始。find和index方法还有逆向查找(从后向前查找)的版本,分别是rfind和rindex,代码如下所示。
s = 'hello good world!'
# 从前向后查找字符o出现的位置(相当于第一次出现)
print(s.find('o'))       # 4
# 从索引为5的位置开始查找字符o出现的位置
print(s.find('o', 5))    # 7
# 从后向前查找字符o出现的位置(相当于最后一次出现)
print(s.rfind('o'))      # 12
3.格式化字符串
在Python中,字符串类型可以通过center、ljust、rjust方法做居中、左对齐和右对齐的处理。如果要在字符串的左侧补零,也可以使用zfill方法。
s = 'hello, world'
# center方法以宽度20将字符串居中并在两侧填充*
print(s.center(20, '*'))  # ****hello, world****
# rjust方法以宽度20将字符串右对齐并在左侧填充空格
print(s.rjust(20))        #         hello, world
# ljust方法以宽度20将字符串左对齐并在右侧填充~
print(s.ljust(20, '~'))   # hello, world~~~~~~~~
# 在字符串的左侧补零
print('33'.zfill(5))      # 00033
print('-33'.zfill(5))     # -0033
我们之前讲过,在用print函数输出字符串时,可以用下面的方式对字符串进行格式化。
a = 321
b = 123
print('%d * %d = %d' % (a, b, a * b))
当然,我们也可以用字符串的方法来完成字符串的格式,代码如下所示。
a = 321
b = 123
print('{0} * {1} = {2}'.format(a, b, a * b))
从Python 3.6开始,格式化字符串还有更为简洁的书写方式,就是在字符串前加上f来格式化字符串,在这种以f打头的字符串中,{变量名}是一个占位符,会被变量对应的值将其替换掉,代码如下所示。
a = 321
b = 123
print(f'{a} * {b} = {a * b}')
如果需要进一步控制格式化语法中变量值的形式,可以参照下面的表格来进行字符串格式化操作。
| 变量值 | 占位符 | 格式化结果 | 说明 | 
|---|---|---|---|
3.1415926 | 
{:.2f} | 
'3.14' | 
保留小数点后两位 | 
3.1415926 | 
{:+.2f} | 
'+3.14' | 
带符号保留小数点后两位 | 
-1 | 
{:+.2f} | 
'-1.00' | 
带符号保留小数点后两位 | 
3.1415926 | 
{:.0f} | 
'3' | 
不带小数 | 
123 | 
{:0>10d} | 
'0000000123' | 
左边补0,补够10位 | 
123 | 
{:x<10d} | 
'123xxxxxxx' | 
右边补x ,补够10位 | 
123 | 
{:>10d} | 
' 123' | 
左边补空格,补够10位 | 
123 | 
{:<10d} | 
'123 ' | 
右边补空格,补够10位 | 
123456789 | 
{:,} | 
'123,456,789' | 
逗号分隔格式 | 
0.123 | 
{:.2%} | 
'12.30%' | 
百分比格式 | 
123456789 | 
{:.2e} | 
'1.23e+08' | 
科学计数法格式 | 
4.替换操作
如果希望用新的内容替换字符串中指定的内容,可以使用replace方法,代码如下所示。replace方法的第一个参数是被替换的内容,第二个参数是替换后的内容,还可以通过第三个参数指定替换的次数。
s = 'hello, world'
print(s.replace('o', '@'))     # hell@, w@rld
print(s.replace('o', '@', 1))  # hell@, world
5.拆分/合并操作
可以使用字符串的split方法将一个字符串拆分为多个字符串(放在一个列表中),也可以使用字符串的join方法将列表中的多个字符串连接成一个字符串,代码如下所示。
s = 'I love you'
words = s.split()
print(words)            # ['I', 'love', 'you']
print('#'.join(words))  # I#love#you

需要说明的是,split方法默认使用空格进行拆分,我们也可以指定其他的字符来拆分字符串,而且还可以指定最大拆分次数来控制拆分的效果,代码如下所示。
# @Time : 2024/2/29 9:18
# @Author : 是Dream呀
# @File : Python 1.py
s = 'I#love#you#so#much'
words = s.split('#')
print(words)
words = s.split('#', 3)
print(words)

注意,如果编码和解码的方式不一致,会导致乱码问题(无法再现原始的内容)或引发UnicodeDecodeError错误导致程序崩溃。
- 点赞
 - 收藏
 - 关注作者
 
            
           
评论(0)