Python中正则表达式怎么用

来源:Vuejs社区作者:Ada头衔:草根站长
导读:本期聚焦于小伙伴创作的《Python中正则表达式怎么用》,敬请观看详情,探索知识的价值。以下视频、文章将为您系统阐述其核心内容与价值。如果您觉得《Python中正则表达式怎么用》有用,将其分享出去将是对创作者最好的鼓励。

Python中正则表达式是通过内置的re模块实现的,它提供了一系列函数来处理字符串的匹配、查找、替换等操作,能够高效解决复杂的字符串处理需求。

Python中正则表达式怎么用

正则表达式基础语法

正则表达式是由普通字符和特殊字符组成的字符串模式,用来描述字符串的匹配规则。常见的特殊字符含义如下:

  • .:匹配除换行符以外的任意单个字符
  • d:匹配任意数字,等价于[0-9]
  • w:匹配字母、数字、下划线,等价于[a-zA-Z0-9_]
  • s:匹配任意空白字符,包括空格、制表符、换行符等
  • *:匹配前面的字符零次或多次
  • +:匹配前面的字符一次或多次
  • ?:匹配前面的字符零次或一次
  • {n}:匹配前面的字符恰好n次
  • {n,m}:匹配前面的字符n到m次
  • []:字符集,匹配其中任意一个字符
  • ^:匹配字符串的开头
  • $:匹配字符串的结尾

re模块核心函数

re.match()

该函数从字符串的开头开始匹配,如果开头不符合模式则返回None,否则返回匹配对象。

import re

# 匹配开头的数字
pattern = r"d+"
string1 = "123abc"
string2 = "abc123"

result1 = re.match(pattern, string1)
result2 = re.match(pattern, string2)

print(result1.group() if result1 else "未匹配")  # 输出:123
print(result2.group() if result2 else "未匹配")  # 输出:未匹配

re.search()

该函数扫描整个字符串,返回第一个匹配到的结果,不管匹配内容在字符串的什么位置。

import re

# 查找字符串中的邮箱
pattern = r"w+@w+.w+"
string = "我的邮箱是test@ipipp.com,备用邮箱是demo@ipipp.com"

result = re.search(pattern, string)
print(result.group() if result else "未匹配")  # 输出:test@ipipp.com

re.findall()

该函数扫描整个字符串,返回所有匹配到的结果组成的列表,没有匹配则返回空列表。

import re

# 查找字符串中的所有数字
pattern = r"d+"
string = "订单号123,金额456,数量789"

result = re.findall(pattern, string)
print(result)  # 输出:['123', '456', '789']

re.sub()

该函数用于替换字符串中匹配到的内容,返回替换后的新字符串。

import re

# 将字符串中的手机号中间四位替换为*
pattern = r"(d{3})d{4}(d{4})"
string = "我的手机号是13812345678"

result = re.sub(pattern, r"1****2", string)
print(result)  # 输出:我的手机号是138****5678

常见使用场景示例

校验手机号格式

国内手机号通常是11位,以1开头,第二位是3-9的数字,后面9位是任意数字。

import re

def check_phone(phone):
    pattern = r"^1[3-9]d{9}$"
    return re.match(pattern, phone) is not None

print(check_phone("13812345678"))  # 输出:True
print(check_phone("12812345678"))  # 输出:False

提取网页中的链接

可以通过正则表达式匹配<a>标签中的href属性值,提取网页中的链接地址。

import re

html_content = "<a href="https://ipipp.com/page1">页面1</a><a href="https://ipipp.com/page2">页面2</a>"
pattern = r"href="(.*?)""

links = re.findall(pattern, html_content)
for link in links:
    print(link)
# 输出:
# https://ipipp.com/page1
# https://ipipp.com/page2

注意事项

在使用正则表达式时,如果模式中包含大量反斜杠,建议使用原始字符串(在字符串前加r),避免反斜杠被Python解释器转义。另外,复杂的正则表达式可读性较差,如果匹配规则过于复杂,可以考虑拆分规则或者使用其他方式处理,避免过度依赖正则表达式。

Python正则表达式re模块匹配规则字符串处理修改时间:2026-07-19 21:42:22

免责声明:​ 已尽一切努力确保本网站所含信息的准确性。网站内容多为原创整理与精心编撰,观点力求客观中立。本站旨在免费分享,内容仅供个人学习、研究或参考使用。若引用了第三方作品,版权归原作者所有。如内容涉及您的权益,请联系我们处理。
内容垂直聚焦
专注技术核心技术栏目,确保每篇文章深度聚焦于实用技能。从代码技巧到架构设计,为用户提供无干扰的纯技术知识沉淀,精准满足专业提升需求。
知识结构清晰
覆盖从开发到部署的全链路。AI、前端、编程、数据库、服务器、建站、系统层层递进,构建清晰学习路径,帮助用户系统化掌握开发与运维所需的核心技术。
深度技术解析
拒绝泛泛而谈,深入技术细节与实践难点。无论是数据库优化还是服务器配置,均结合真实场景与代码示例进行剖析,致力于提供可直接应用于工作的解决方案。
专业领域覆盖
精准对应开发生命周期。从前端界面到后端编程,从数据库操作到服务器运维,形成完整闭环,一站式满足全栈工程师和运维人员的技术需求。
即学即用高效
内容强调实操性,步骤清晰、代码完整。用户可根据教程直接复现和应用于自身项目,显著缩短从学习到实践的距离,快速解决开发中的具体问题。
持续更新保障
专注既定技术方向进行长期、稳定的内容输出。确保各栏目技术文章持续更新迭代,紧跟主流技术发展趋势,为用户提供经久不衰的学习价值。