在Java开发中,XML常用于配置文件和数据传输。JAXP(Java API for XML Processing)是官方提供的统一接口,开发者可以通过它使用DOM或SAX等方式处理XML。其中DOM解析会将文档整体加载为内存中的节点树,便于操作和修改。

JAXP与DOM解析基础
JAXP本身不包含解析器实现,而是通过工厂模式调用JDK内置的解析器。使用DOM时,核心类包括DocumentBuilderFactory、DocumentBuilder和Document。下面通过一个简单示例说明如何解析XML。
示例XML文件
假设有一个名为book.xml的文件,内容如下:
<?xml version="1.0" encoding="UTF-8"?>
<library>
<book id="1">
<name>Java编程思想</name>
<author>Bruce Eckel</author>
</book>
<book id="2">
<name>Effective Java</name>
<author>Joshua Bloch</author>
</book>
</library>
使用JAXP的DOM解析代码
以下Java代码展示如何读取上述XML并输出每本书的名称和作者:
import javax.xml.parsers.DocumentBuilder;
import javax.xml.parsers.DocumentBuilderFactory;
import org.w3c.dom.Document;
import org.w3c.dom.NodeList;
import org.w3c.dom.Element;
import java.io.File;
public class DomParseDemo {
public static void main(String[] args) throws Exception {
// 创建解析器工厂
DocumentBuilderFactory factory = DocumentBuilderFactory.newInstance();
// 获取DOM解析器
DocumentBuilder builder = factory.newDocumentBuilder();
// 解析XML文件得到Document对象
Document doc = builder.parse(new File("book.xml"));
// 获取所有book节点
NodeList books = doc.getElementsByTagName("book");
for (int i = 0; i < books.getLength(); i++) {
Element book = (Element) books.item(i);
// 读取name和author子元素文本
String name = book.getElementsByTagName("name").item(0).getTextContent();
String author = book.getElementsByTagName("author").item(0).getTextContent();
System.out.println("书名:" + name + ",作者:" + author);
}
}
}
关键步骤说明
- 调用DocumentBuilderFactory.newInstance()获得工厂实例。
- 通过工厂创建DocumentBuilder对象,它是真正执行解析的类。
- 使用parse方法加载XML,返回代表整个文档的Document树。
- 借助getElementsByTagName等方法定位节点,getTextContent读取内容。
注意事项
DOM解析会将整个文档放入内存,处理超大XML时可能占用过多资源。若只需顺序读取,可考虑SAX或StAX。另外在代码中提及的HTML标签如<input>与XML解析无关,仅作字符转义示例。实际解析时应确保XML格式良好,否则会抛出异常。
DOM适合需要修改结构或反复查询的场景,JAXP让我们无需关心底层解析器细节。
小结
通过JAXP的DOM解析,开发者能以标准方式加载并操作XML。掌握DocumentBuilderFactory与Document的使用,基本可以满足常见配置读取需求。