XQuery是W3C制定的一种函数式查询语言,专门用于处理XML格式的数据,它的核心作用是快速从XML数据源中提取、筛选、转换和构造新的XML内容。XQuery的设计目标就是简化XML数据的查询流程,不需要开发者手动解析整个XML文档再逐层遍历查找内容。

XQuery的核心特性
XQuery具备多个适配XML数据处理的核心特性,这些特性让它成为XML查询场景下的主流选择:
- 原生支持XML数据类型,查询过程中可以直接操作XML的元素、属性、文本节点等结构
- 完全兼容XPath 2.0及以上版本的语法,XPath的表达式可以直接嵌入XQuery语句中使用
- 支持FLWOR表达式,这是XQuery特有的结构化查询语法,类似SQL的查询逻辑
- 属于函数式语言,没有副作用,相同的查询输入一定会得到相同的输出结果
- 可以输出多种格式的结果,除了XML之外,还可以输出文本、HTML、JSON等格式
XQuery的基础语法组成
1. XPath表达式基础
因为XQuery兼容XPath,所以基础的路径表达式是XQuery的重要组成部分,用来定位XML中的节点:
<bookstore>
<book category="web">
<title>XQuery入门</title>
<author>张三</author>
<price>59.9</price>
</book>
<book category="database">
<title>数据库原理</title>
<author>李四</author>
<price>69.9</price>
</book>
</bookstore>
如果要查询所有book节点的title内容,使用XPath表达式//book/title就可以直接定位到对应节点。
2. FLWOR表达式
FLWOR是XQuery最核心的结构化查询语法,对应For、Let、Where、Order by、Return五个关键字,功能类似SQL的SELECT语句:
for $book in //book
let $price := $book/price
where $price > 60
order by $price descending
return
<expensive_book>
{$book/title}
{$book/author}
{$book/price}
</expensive_book>
这段语句的作用是遍历所有book节点,筛选出价格大于60的书籍,按照价格降序排列,最后构造一个新的expensive_book节点返回结果。
XQuery的常见应用场景
XQuery在实际开发中有很多典型的应用场景:
- XML数据库查询:很多原生XML数据库比如BaseX、eXist-db都直接支持XQuery作为查询语言
- Web服务数据解析:当接口返回XML格式的数据时,可以用XQuery快速提取需要的字段
- XML文档转换:可以将一种结构的XML文档转换成另一种结构的XML、HTML或者文本
- 企业数据集成:不同系统之间如果通过XML格式交换数据,可以用XQuery统一处理不同来源的XML数据
XQuery和其他XML处理技术的区别
很多开发者会混淆XQuery和XSLT、DOM解析的区别,三者的核心差异如下:
| 技术名称 | 核心定位 | 适用场景 |
|---|---|---|
| XQuery | XML查询语言 | 快速提取、筛选XML数据,适合查询类需求 |
| XSLT | XML转换语言 | XML文档的格式转换,适合复杂的样式转换需求 |
| DOM解析 | XML文档对象模型 | 需要修改XML结构、遍历整个文档树的操作 |
简单的XQuery入门示例
下面是一个完整的XQuery查询示例,查询所有分类为web的书籍信息:
xquery version "3.0";
declare variable $xml := document {
<bookstore>
<book category="web">
<title>XQuery入门</title>
<author>张三</author>
<price>59.9</price>
</book>
<book category="database">
<title>数据库原理</title>
<author>李四</author>
<price>69.9</price>
</book>
</bookstore>
};
for $b in $xml//book[@category="web"]
return
<result>
<book_title>{data($b/title)}</book_title>
<book_author>{data($b/author)}</book_author>
<book_price>{data($b/price)}</book_price>
</result>
这段语句首先声明了XML变量,然后遍历分类为web的book节点,提取title、author、price的内容构造新的result节点返回,最终会得到对应web分类书籍的信息。