XPath的contains()方法是用于字符串模糊匹配的内置函数,主要作用是在定位节点时,判断目标节点的文本内容或者属性值中是否包含指定的子字符串,不需要完全匹配整个字符串就能完成节点筛选,在XML解析、网页爬虫、自动化测试等场景中都有广泛应用。

contains()方法的基础语法
contains()方法的语法格式非常简单,它接收两个参数,第一个参数是需要被检查的字符串,第二个参数是要查找的子字符串,返回值为布尔类型,当第一个参数包含第二个参数时返回true,否则返回false。基础语法如下:
<!-- XPath表达式基础结构 --> contains(string_to_check, substring_to_find)
在实际的XPath节点定位中,通常会把contains()方法放在谓语中,用来筛选符合条件的节点,常见的使用形式有两种:
1. 匹配节点文本内容
当需要筛选文本内容中包含特定关键词的节点时,可以使用text()函数获取节点的文本内容,再传入contains()方法的第一个参数:
<!-- 查找所有文本内容包含"教程"的div节点 --> //div[contains(text(), "教程")]
2. 匹配节点属性值
如果需要筛选属性值中包含特定内容的节点,可以直接将属性访问表达式作为contains()的第一个参数:
<!-- 查找所有class属性包含"active"的li节点 --> //li[contains(@class, "active")]
contains()方法的使用注意事项
在使用contains()方法时,有几个细节需要特别注意,避免出现定位错误:
- contains()方法是大小写敏感的,比如查找"Test"和查找"test"会得到不同的结果,如果需要忽略大小写,可以结合translate()函数处理字符串。
- 当被检查的字符串或者子字符串为null时,contains()的返回结果在不同XPath解析器中可能有差异,建议提前确认解析器的处理逻辑。
- contains()是模糊匹配,只要包含子字符串就会命中,如果需要完全匹配,应该使用等号=进行判断,而不是contains()。
contains()方法的常见应用场景
场景一:网页爬虫中的节点定位
在爬取网页数据时,很多网页的class属性或者id属性会带有动态后缀,比如商品列表的class可能是"goods-item-123"、"goods-item-456",这时候无法用完全匹配定位所有商品节点,就可以用contains()方法:
<!-- 定位所有class属性包含"goods-item"的div节点,即所有商品项 --> //div[contains(@class, "goods-item")]
假设我们要爬取的网页结构如下:
<div class="goods-list">
<div class="goods-item-1">商品1</div>
<div class="goods-item-2">商品2</div>
<div class="goods-item-3">商品3</div>
</div>
使用上面的XPath表达式就能一次性获取到三个商品节点,不需要逐个编写完全匹配的XPath。
场景二:自动化测试中的元素定位
在做UI自动化测试时,有些页面的按钮文本或者提示文本是动态变化的,比如提交按钮可能在加载时显示"提交中",加载完成后显示"提交",这时候可以用contains()匹配文本中的固定部分:
<!-- 定位文本中包含"提交"的button节点 --> //button[contains(text(), "提交")]
这样不管按钮文本是"提交"还是"提交中",都能被成功定位到,提升自动化脚本的稳定性。
场景三:XML配置文件的节点筛选
在处理XML格式的配置文件时,有时候需要根据节点的某个属性值的部分内容筛选节点,比如配置中有多个环境相关的配置项,属性值带有"dev"、"prod"等标识:
<config>
<item env="dev-server-01">开发环境配置1</item>
<item env="dev-server-02">开发环境配置2</item>
<item env="prod-server-01">生产环境配置1</item>
</config>
如果需要获取所有开发环境的配置项,可以使用如下XPath表达式:
//item[contains(@env, "dev")]
这个表达式会匹配到env属性包含"dev"的两个item节点,满足筛选需求。
contains()方法结合其他函数的使用示例
contains()方法还可以和其他XPath函数结合使用,实现更复杂的筛选逻辑,比如和and、or逻辑运算符结合,同时匹配多个条件:
<!-- 查找class包含"item"且文本内容包含"推荐"的div节点 --> //div[contains(@class, "item") and contains(text(), "推荐")]
再比如结合normalize-space()函数处理文本中的多余空格,避免因为文本前后有空格导致匹配失败:
<!-- 处理文本前后空格后再匹配 --> //div[contains(normalize-space(text()), "教程")]
通过灵活组合这些函数,可以满足绝大多数模糊匹配的节点定位需求。
XPathcontains方法XML解析HTML爬虫节点定位修改时间:2026-07-19 22:45:26