python sax解析xml

#books.xml
<catalog>

    <book isbn="0-596-00128-2">

        <title>Python &amp; XML</title>

        <title>Python &amp; HTML</title>

        <date>December 2001</date>

        <author>Jones, Drake</author>

    </book>

    <book isbn="0-596-15810-6">

        <title>Programming Python, 4th Edition</title>

        <date>October 2010</date>

        <author>Lutz</author>

    </book>

    <book isbn="0-596-15806-8">

        <title>Learning Python, 4th Edition</title>

        <date>September 2009</date>

        <author>Lutz</author>

    </book>

    <book isbn="0-596-15808-4">

        <title>Python Pocket Reference, 4th Edition</title>

        <date>October 2009</date>

        <author>Lutz</author>

    </book>

    <book isbn="0-596-00797-3">

        <title>Python Cookbook, 2nd Edition</title>

        <date>March 2005</date>

        <author>Martelli, Ravenscroft, Ascher</author>

    </book>

    <book isbn="0-596-10046-9">

        <title>Python in a Nutshell, 2nd Edition</title>

        <date>July 2006</date>

        <author>Martelli</author>

    </book>

    <!-- plus many more Python books that should appear here -->

</catalog>

#conding:utf-8

# -*- coding:utf-8 -*-

__author__ = 'hdfs'

'''

总的来说 sax解析xml 进行3个阶段 sax是线性解析对于大的xml会很有效率

'''

import xml.sax,xml.sax.handler,pprint

class BookHandler(xml.sax.handler.ContentHandler):

    def __init__(self):

        self.inTitle=False

        self.mapping={}

    def startElement(self, name, attrs):

        #book标签开始

        if name=="book":

            self.buffer=""

            self.isbn=attrs["isbn"]

        #title标签开始

        elif name=="title":

            self.inTitle=True

    def characters(self,data):

        #如果真的进入buffer 关联多个子节点的数据

        if self.inTitle:

            self.buffer+=data

    #结束一个元素的遍历

    def endElement(self,name):

        if name=="title":

            self.inTitle=False

            self.mapping[self.isbn]=self.buffer

parser=xml.sax.make_parser()

handler=BookHandler()

parser.setContentHandler(handler)

parser.parse('books.xml')

pprint.pprint(handler.mapping)

result:

{u'0-596-00128-2': u'Python & XMLPython & HTML',

 u'0-596-00797-3': u'Python Cookbook, 2nd Edition',

 u'0-596-10046-9': u'Python in a Nutshell, 2nd Edition',

 u'0-596-15806-8': u'Learning Python, 4th Edition',

 u'0-596-15808-4': u'Python Pocket Reference, 4th Edition',

 u'0-596-15810-6': u'Programming Python, 4th Edition'}

python sax解析xml的更多相关文章

Python：使用基于事件驱动的SAX解析XML
SAX的特点: 是基于事件的 API 在一个比 DOM 低的级别上操作为您提供比 DOM 更多的控制几乎总是比 DOM 更有效率但不幸的是,需要比 DOM 更多的工作基于对象和基于事件的接口 ...
Python—使用xml.sax解析xml文件
什么是sax? SAX是一种基于事件驱动的API. 利用SAX解析XML文档牵涉到两个部分:解析器和事件处理器. 解析器负责读取XML文档,并向事件处理器发送事件,如元素开始跟元素结束事件; 而事件处 ...
用 ElementTree 在 Python 中解析 XML
用 ElementTree 在 Python 中解析 XML 原文: http://eli.thegreenplace.net/2012/03/15/processing-xml-in-python- ...
Android之SAX解析XML
一．SAX解析方法介绍 SAX(Simple API for XML)是一个解析速度快并且占用内存少的XML解析器,非常适合用于Android等移动设备. SAX解析器是一种基于事件的解析器,事件驱动 ...
Android 使用pull,sax解析xml
pull解析xml文件 1.获得XmlpullParser类的引用这里有两种方法 //解析器工厂 XmlPullParserFactory factory=XmlPullParserFactory. ...
JAVA使用SAX解析XML文件
在我的另一篇文章(http://www.cnblogs.com/anivia/p/5849712.html)中,通过一个例子介绍了使用DOM来解析XML文件,那么本篇文章通过相同的XML文件介绍如何使 ...
DOM&SAX解析XML
在上一篇随笔中分析了xml以及它的两种验证方式.我们有了xml,但是里面的内容要怎么才能得到呢?如果得不到的话,那么还是没用的,解析xml的方式主要有DOM跟SAX,其中DOM是W3C官方的解析方式, ...
cocos2d-x 3.0 使用Sax解析xml文件（中国显示器问题解决）
今天是个好日子.我以为事情可以变得,明天是个好日子.打开门儿春风... 恩,听着歌写文档生活就是这么享受. 今天曾经的邻居大神突然在qq上赞了我一下,这让我异常激动啊.. 这还要从前前前几天说起,那会 ...
SAX解析xml浅析
SAX解析XML文件采用事件驱动的方式进行,也就是说,SAX是逐行扫描文件,遇到符合条件的设定条件后就会触发特定的事件,回调你写好的事件处理程序.使用SAX的优势在于其解析速度较快,占用内存较少(相对 ...

随机推荐

转：Java 动态代理的内部实现机制（大体意思正确，写的还行的一篇文章）
转:Java动态绑定的内部实现机制 JAVA虚拟机调用一个类方法时,它会基于对象引用的类型(通常在编译时可知)来选择所调用的方法.相反,当虚拟机调用一个实例方法时,它会基于对象实际的类型(只能在运行 ...
asp.net 字符串替换、截取。
有时候要在一段字符串里面把某些字符替换成其他字符,怎么办? 例如: string image=@"csks/news/user_top/qqqq/qqqq.jpg"; image ...
[TYVJ1930]编年史
现在 applepi 手上有一本十分古老的编年史,这本史书记录了很多著名的历史事件.于是applepi 有了一个奇怪的想法……他想知道那些有名的历史事件都是在星期几发生的.现在轮到你了,你要帮助app ...
LOJ#2132. 「NOI2015」荷马史诗
$n \leq 100000$个数字,放进$k$叉树里,一个点只能放一个数,使所有数字乘以各自深度这个值之和最小的同时,最大深度的数字最小. 哈夫曼.这是我刚学OI那段时间看到的,感觉就是个很无聊的贪 ...
获取所有querystring变量名
原文发布时间为:2009-12-04 -- 来源于本人的百度文章 [由搬家工具导入] protected void Page_Load(object sender, EventArgs e) { ...
C#设计模式视频教程（不知道讲的好不好，刚刚看到）
原文发布时间为:2008-12-08 -- 来源于本人的百度文章 [由搬家工具导入] http://u.youku.com/user_video/uid_happyboy27.html 优酷网。。
mvc filters
1.controller using System; using System.Collections.Generic; using System.Linq; using System.Web; us ...
linux安全机制学习【转】
转自:http://blog.csdn.net/qq_20307987/article/details/51307820 曾经一度想学来着,今天看到一个链接,讲的很好,算是写一下加深印象吧 1 栈溢出 ...
saltstack 模块学习之 state
入口文件top.sls 三要素环境:通过file-roots指定目标主机:可以使用通配符*配置文件路径:路径分割符为. 比如a.mysql 表示在环境指定的路径下有个a目录,a目录下有个mysql. ...
安装聊天软件telegram-cli
Telegram是一款加密通信的聊天软件,可以在linux,windows,android,chrome等运行.官方网址:https://telegram.org/ 它是有桌面版的,但作为一个linu ...

python sax解析xml

python sax解析xml的更多相关文章

随机推荐

热门专题