在Web自动化里,分页数据常因接口慢、渲染延迟导致脚本取不到完整内容。Karate的UI自动化模块可以用waitUntil等待指定条件成立,再配合循环与条件判断,稳定地完成多页数据采集,避免漏采或元素找不到的异常。

为什么分页采集需要waitUntil
分页按钮或列表通常在接口返回后才渲染。如果脚本不等待就读取,会拿到空列表。Karate的waitUntil能阻塞到表达式为真,比如某页的表格行数大于0,或下一页按钮可见。
基础脚本结构
下面示例用Karate驱动浏览器打开列表页,循环点击下一页并采集每页行文本,直到没有下一页按钮。
Feature: 分页数据采集示例
Scenario: 采集所有分页数据
* configure driver = { type: 'chrome', start: true }
* driver 'https://ipipp.com/list'
* def allData = []
* eval
"""
var page = 1;
while (true) {
// 等待当前页表格行出现
waitUntil("document.querySelectorAll('tr.data-row').length > 0");
var rows = scriptAll("tr.data-row", "el => el.innerText");
allData = allData.concat(rows);
// 判断下一页按钮是否存在且可见
var hasNext = script("button.next-page", "el => el && !el.disabled");
if (!hasNext) {
break;
}
click("button.next-page")
page++;
}
"""
* print allData.length
条件逻辑的关键点
在循环里,我们用script()返回布尔值判断下一页状态。若按钮被禁用或不存在,说明已是末页,用break退出。这样无论后端一共返回几页,脚本都能自适应。
常见等待条件写法
- waitUntil("el('#loading').length == 0") 等待加载层消失
- waitUntil("document.readyState == 'complete'") 等待文档加载完
- waitUntil("el('.next-page').isEnabled()") 等待按钮可点
处理异步加载更稳的方式
有些列表用滚动或延迟渲染,可在waitUntil里加更具体的业务条件,比如某行包含已知文本:
// 等待包含“用户A”的行出现
waitUntil("Array.from(document.querySelectorAll('tr.data-row')).some(r => r.innerText.includes('用户A'))");
小结
用Karate做UI分页采集,核心是把waitUntil当作同步闸门,把条件逻辑写在循环里决定翻页与否。比起硬性sleep,这种方式更快也更不容易漏数据,适合中小规模的页面抓取与回归验证。