导读:本期聚焦于小伙伴创作的《XPath的contains()方法怎么用?有哪些应用场景?》,敬请观看详情,探索知识的价值。以下视频、文章将为您系统阐述其核心内容与价值。如果您觉得《XPath的contains()方法怎么用?有哪些应用场景?》有用,将其分享出去将是对创作者最好的鼓励。

XPath的contains()方法是用于字符串模糊匹配的内置函数,主要作用是在定位节点时,判断目标节点的文本内容或者属性值中是否包含指定的子字符串,不需要完全匹配整个字符串就能完成节点筛选,在XML解析、网页爬虫、自动化测试等场景中都有广泛应用。

XPath的contains()方法怎么用?有哪些应用场景?

contains()方法的基础语法

contains()方法的语法格式非常简单,它接收两个参数,第一个参数是需要被检查的字符串,第二个参数是要查找的子字符串,返回值为布尔类型,当第一个参数包含第二个参数时返回true,否则返回false。基础语法如下:

<!-- XPath表达式基础结构 -->
contains(string_to_check, substring_to_find)

在实际的XPath节点定位中,通常会把contains()方法放在谓语中,用来筛选符合条件的节点,常见的使用形式有两种:

1. 匹配节点文本内容

当需要筛选文本内容中包含特定关键词的节点时,可以使用text()函数获取节点的文本内容,再传入contains()方法的第一个参数:

<!-- 查找所有文本内容包含"教程"的div节点 -->
//div[contains(text(), "教程")]

2. 匹配节点属性值

如果需要筛选属性值中包含特定内容的节点,可以直接将属性访问表达式作为contains()的第一个参数:

<!-- 查找所有class属性包含"active"的li节点 -->
//li[contains(@class, "active")]

contains()方法的使用注意事项

在使用contains()方法时,有几个细节需要特别注意,避免出现定位错误:

  • contains()方法是大小写敏感的,比如查找"Test"和查找"test"会得到不同的结果,如果需要忽略大小写,可以结合translate()函数处理字符串。
  • 当被检查的字符串或者子字符串为null时,contains()的返回结果在不同XPath解析器中可能有差异,建议提前确认解析器的处理逻辑。
  • contains()是模糊匹配,只要包含子字符串就会命中,如果需要完全匹配,应该使用等号=进行判断,而不是contains()。

contains()方法的常见应用场景

场景一:网页爬虫中的节点定位

在爬取网页数据时,很多网页的class属性或者id属性会带有动态后缀,比如商品列表的class可能是"goods-item-123"、"goods-item-456",这时候无法用完全匹配定位所有商品节点,就可以用contains()方法:

<!-- 定位所有class属性包含"goods-item"的div节点,即所有商品项 -->
//div[contains(@class, "goods-item")]

假设我们要爬取的网页结构如下:

<div class="goods-list">
    <div class="goods-item-1">商品1</div>
    <div class="goods-item-2">商品2</div>
    <div class="goods-item-3">商品3</div>
</div>

使用上面的XPath表达式就能一次性获取到三个商品节点,不需要逐个编写完全匹配的XPath。

场景二:自动化测试中的元素定位

在做UI自动化测试时,有些页面的按钮文本或者提示文本是动态变化的,比如提交按钮可能在加载时显示"提交中",加载完成后显示"提交",这时候可以用contains()匹配文本中的固定部分:

<!-- 定位文本中包含"提交"的button节点 -->
//button[contains(text(), "提交")]

这样不管按钮文本是"提交"还是"提交中",都能被成功定位到,提升自动化脚本的稳定性。

场景三:XML配置文件的节点筛选

在处理XML格式的配置文件时,有时候需要根据节点的某个属性值的部分内容筛选节点,比如配置中有多个环境相关的配置项,属性值带有"dev"、"prod"等标识:

<config>
    <item env="dev-server-01">开发环境配置1</item>
    <item env="dev-server-02">开发环境配置2</item>
    <item env="prod-server-01">生产环境配置1</item>
</config>

如果需要获取所有开发环境的配置项,可以使用如下XPath表达式:

//item[contains(@env, "dev")]

这个表达式会匹配到env属性包含"dev"的两个item节点,满足筛选需求。

contains()方法结合其他函数的使用示例

contains()方法还可以和其他XPath函数结合使用,实现更复杂的筛选逻辑,比如和and、or逻辑运算符结合,同时匹配多个条件:

<!-- 查找class包含"item"且文本内容包含"推荐"的div节点 -->
//div[contains(@class, "item") and contains(text(), "推荐")]

再比如结合normalize-space()函数处理文本中的多余空格,避免因为文本前后有空格导致匹配失败:

<!-- 处理文本前后空格后再匹配 -->
//div[contains(normalize-space(text()), "教程")]

通过灵活组合这些函数,可以满足绝大多数模糊匹配的节点定位需求。

XPathcontains方法XML解析HTML爬虫节点定位修改时间:2026-07-19 22:45:26

免责声明:​ 已尽一切努力确保本网站所含信息的准确性。网站内容多为原创整理与精心编撰,观点力求客观中立。本站旨在免费分享,内容仅供个人学习、研究或参考使用。若引用了第三方作品,版权归原作者所有。如内容涉及您的权益,请联系我们处理。
内容垂直聚焦
专注技术核心技术栏目,确保每篇文章深度聚焦于实用技能。从代码技巧到架构设计,为用户提供无干扰的纯技术知识沉淀,精准满足专业提升需求。
知识结构清晰
覆盖从开发到部署的全链路。AI、前端、编程、数据库、服务器、建站、系统层层递进,构建清晰学习路径,帮助用户系统化掌握开发与运维所需的核心技术。
深度技术解析
拒绝泛泛而谈,深入技术细节与实践难点。无论是数据库优化还是服务器配置,均结合真实场景与代码示例进行剖析,致力于提供可直接应用于工作的解决方案。
专业领域覆盖
精准对应开发生命周期。从前端界面到后端编程,从数据库操作到服务器运维,形成完整闭环,一站式满足全栈工程师和运维人员的技术需求。
即学即用高效
内容强调实操性,步骤清晰、代码完整。用户可根据教程直接复现和应用于自身项目,显著缩短从学习到实践的距离,快速解决开发中的具体问题。
持续更新保障
专注既定技术方向进行长期、稳定的内容输出。确保各栏目技术文章持续更新迭代,紧跟主流技术发展趋势,为用户提供经久不衰的学习价值。