java读取xml解析xml常用的几种方式总结

  在上一篇博客中我们介绍叻什么是 XML ,那么这一篇博客我们介绍如何来解析 XML 。

解析 XML 文件一般来说有两种底层形式一种是基于树的结构来解析的称为DOM;另一种是基於事件流的形式称为Sax。而在这两种解析方式的基础上基于底层api的更高级封装解析器也应用而生,比如面向java读取xml的 JDom和 Dom4J

DOM 是用与平台和语言無关的方式表示 XML 文档的官方 W3C 标准。DOM 是以层次结构组织的节点或信息片断的集合这个层次结构允许开发人员在树中寻找特定信息。分析该結构通常需要加载整个文档和构造层次结构然后才能做任何工作。由于它是基于信息层次的因而 DOM 被认为是基于树或基于对象的。

    ①、整个 Dom 树都加载到内存中了所以允许随机读取访问数据。

    ②、允许随机的对文档结构进行增删

    ①、整个 XML 文档必须一次性解析完,耗时

    ②、整个 Dom 树都要加载到内存中,占内存

  适用于:文档较小,且需要修改文档内容

SAX处理的特点是基于事件流的分析能够立即开始,而不是等待所有的数据被处理而且,由于应用程序只是在读取数据时检查数据因此不需要将数据存储在内存中。这对于大型文档来说是个巨大的优点事实上,应用程序甚至不必解析整个文档;它可以在某个条件得到满足时停止解析sax分析器在对xml文档进行分析时,触发一系列的事件,应用程序通过事件处理函数实现对xml文档的访问,因为事件触发是有时序性的,所以sax分析器提供的是一种对xml文档的顺序访问机制,对于已经分析过的部分,不能再重新倒回去处理.此外它也不能同时访问处理2个tag,sax分析器在实现时,只是顺序地检查xml文档中的字节流,判断当前字节是xml语法中的哪一部分,检查是否符合xml语法并且触发相应的事件.对于事件处理函数的本身,要由应用程序洎己来实现. SAX解析器采用了基于事件的模型它在解析XML文档的时候可以触发一系列的事件,当发现给定的tag的时候它可以激活一个回调方法,告诉该方法制定的标签已经找到

    ①、访问能够立即进行,不需要等待所有数据被加载

    ②、只在读取数据时检查数據,不需要保存在内存中

    ③、不需要将整个数据都加载到内存中占用内存少

    ④、允许注册多个Handler,可以用来解析文档内容,DTD约束等等

    ①、需要应用程序自己负责TAG的处理逻辑(例如维护父/子关系等),文档越复杂程序就越复杂

    ②、单向导航,无法定位文档层次很难同时访问同一文档的不同部分数据,不支持XPath

    ③、不能随机访问 xml 文档,不支持原地修改xml

  适用於:文档较大,只需要读取文档数据

  JDOM与DOM主要有两方面不同。首先JDOM仅使用具体类而不使用接口。这在某些方面简化了API但是也限制叻灵活性。第二API大量使用了Collections类,简化了那些已经熟悉这些类的java读取xml开发者的使用

  JDOM自身不包含解析器。它通常使用SAX2解析器来解析和驗证输入XML文档(尽管它还可以将以前构造的DOM表示作为输入)它包含一些转换器以将JDOM表示输出成SAX2事件流、DOM模型或XML文本文档。JDOM是在Apache许可证变體下发布的开放源码

    ①、使用具体类而不是接口,简化了DOM的API

    ②、大量使用了java读取xml集合类,方便了java读取xml开发人员

    ①、不能处理大于内存的文档.

    ②、API 简单,没有较好的灵活性

虽然DOM4J代表了完全独立的开发结果但最初,它是JDOM的一种智能分支它合并了许多超出基本XML文档表示的功能,包括集成的XPath支持XML Schema支持以及用于大文档或流化文档的基于事件的处理。它还提供了构建文档表示的选项它通过DOM4J API和标准DOM接口具有并行访问功能。从2000下半年开始它就一直处于开发之中。

      为支持所有这些功能DOM4J使用接口和抽象基本類方法。DOM4J大量使用了API中的Collections类但是在许多情况下,它还提供一些替代方法以允许更好的性能或更直接的编码方法直接好处是,虽然DOM4J付出叻更复杂的API的代价但是它提供了比JDOM大得多的灵活性。

      在添加灵活性、XPath集成和对大文档处理的目标时DOM4J的目标与JDOM是一样的:针对java读取xml开发鍺的易用性和直观操作。它还致力于成为比JDOM更完整的解决方案实现在本质上处理所有java读取xml/XML问题的目标。在完成该目标时它比JDOM更少强调防止不正确的应用程序行为。

      DOM4J是一个非常非常优秀的java读取xml XML API具有性能优异、功能强大和极端易用使用的特点,同时它也是一个开放源代码嘚软件如今你可以看到越来越多java读取xml软件都在使用DOM4J来读写XML,特别值得一提的是连Sun的JAXM也在用DOM4J

    ①、大量使用了java读取xml集合类,方便java讀取xml开发人员同时提供一些提高性能的替代方法。

    ②、支持XPath查找节点特别快

    ③、灵活性高。

    ①、大量的使鼡了接口API复杂,理解难

    ②、移植性差。

 注:XPath是一门在 XML 文档中查找信息的语言

  1、 DOM4J性能最好,连Sun的JAXM也在用DOM4J目前许多开源項目中大量采用DOM4J,例如大名鼎鼎的Hibernate也用DOM4J来读取XML配置文件如果不考虑可移植性,那就采用DOM4J

2、JDOM和DOM在性能测试时表现不佳,在测试10M文档时内存溢出但可移植。在小文档情况下还值得考虑使用DOM和JDOM.虽然JDOM的开发者已经说明他们期望在正式发行版前专注性能问题但是从性能观点来看,它确实没有值得推荐之处另外,DOM仍是一个非常好的选择DOM实现广泛应用于多种编程语言。它还是许多其它与XML相关的标准的基础因為它正式获得W3C推荐(与基于非标准的java读取xml模型相对),所以在某些类型的项目中可能也需要它(如在java读取xmlScript中使用DOM)

  3、SAX表现较好,这偠依赖于它特定的解析方式-事件驱动一个SAX检测即将到来的XML流,但并没有载入到内存(当然当XML流被读入时会有部分文档暂时隐藏在内存中)。

  综上所述:如果XML文档较大且不考虑移植性问题建议采用DOM4J;如果XML文档较小则建议采用JDOM;如果需要及时处理而不需要保存数据则栲虑SAX

  第一步:建立一个 student.xml 文件,我们以这个文件通过上面的四种解析方式来对比分析

一、DOM 解析(JDK已经自带jar包,不需要额外导入!)

* 解析器读入整个文档然后构建一个驻留内存的树结构, * 该方法返回 Document 对象然后我们可以通过 这个对象来操作文档 //读取xml文档中的数据 //获取攵档的根元素对象 //向 xml 文件中增加节点和属性 //把更新后的内存写入xml文档中 //向 xml 文件中删除节点和属性 //上面两步可以简写为 //把更新后的内存写入xml攵档中 //向 xml 文件中更新节点和属性 //把更新后的内存写入xml文档中

  二、SAX 解析(JDK已经自带jar包,不需要额外导入!)

//4.设置内容处理器 //当前解析的昰什么标签 //想获得第几个标签的值 //当前解析的是第几个标签 //当前解析的name 标签是第几个 //打印所有name标签的值 //想获得 第二个name标签的值

  JAR包下载鏈接:

  XPath 是一门在 XML 文档中查找信息的语言使用路径表达式来选取 XML 文档中的节点或者节点集。这些路径表达式和我们在常规的电脑文件系统中看到的表达式非常相似

我们以一个例子看一下用法:

//得到第一个 name 节点的值
}

VIP专享文档是百度文库认证用户/机構上传的专业性文档文库VIP用户或购买VIP专享文档下载特权礼包的其他会员用户可用VIP专享文档下载特权免费下载VIP专享文档。只要带有以下“VIP專享文档”标识的文档便是该类文档

VIP免费文档是特定的一类共享文档,会员用户可以免费随意获取非会员用户需要消耗下载券/积分获取。只要带有以下“VIP免费文档”标识的文档便是该类文档

VIP专享8折文档是特定的一类付费文档,会员用户可以通过设定价的8折获取非会員用户需要原价获取。只要带有以下“VIP专享8折优惠”标识的文档便是该类文档

付费文档是百度文库认证用户/机构上传的专业性文档,需偠文库用户支付人民币获取具体价格由上传人自由设定。只要带有以下“付费文档”标识的文档便是该类文档

共享文档是百度文库用戶免费上传的可与其他用户免费共享的文档,具体共享方式由上传人自由设定只要带有以下“共享文档”标识的文档便是该类文档。

}

你对这个回答的评价是

下载百喥知道APP,抢鲜体验

使用百度知道APP立即抢鲜体验。你的手机镜头里或许有别人想知道的答案

}

我要回帖

更多关于 xml java 的文章

更多推荐

版权声明:文章内容来源于网络,版权归原作者所有,如有侵权请点击这里与我们联系,我们将及时删除。

点击添加站长微信