python 使用 xml.etree.ElementTree 解析 xml

2023-10-04 00:01

本文主要是介绍python 使用 xml.etree.ElementTree 解析 xml,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

使用 xml.etree.ElementTree  (简称ET) 来解析 xml  非常好用推荐给大家。按照我自己的理解,使用ET 解析xml 就像 遍历 字典一样 ,以如下数据为例

<?xml version="1.0" encoding="utf-8"?><SMP2019-ECISA><Doc ID="4"><Sentence ID="1" label="2">转发了财新网的微博:【内鬼与大鳄姚刚张育军的唏嘘人生】(记者刘彩萍)近日,中国证券监督管理委员会原党委委员、副主席姚刚和原党委委员、主席助理张育军被查。</Sentence><Sentence ID="2">两位高级干部先后被双开并移交司法引发资本市场无限唏嘘,曾经的后备干部、创新先锋倒在了利益面前。</Sentence><Sentence ID="3">内鬼与大鳄姚刚张育军的唏嘘人生??</Sentence><Sentence ID="4">原图?</Sentence><Sentence ID="5">赞[21]?</Sentence><Sentence ID="6">原文转发[29]?</Sentence><Sentence ID="7">原文评论[52]转发理由:副主席,江湖上称发审皇帝,IPO审批制的坚决拥护者。</Sentence><Sentence ID="8">攀附山西王成,让一大批乐视这种垃圾公司上市,权?</Sentence><Sentence ID="9">贵牛的中枢。</Sentence><Sentence ID="10">人民牛,还缺一个市场化IPO,还多一个发审委。</Sentence></Doc>
</SMP2019-ECISA>

具体代码如下

import xml.etree.ElementTree as ETin_file = 'SMP2019_ECISA_Dev.xml'
tree = ET.parse(in_file)
# 获得根节点 SMP2019-ECISA
root = tree.getroot()
# 遍历根节点
for doc in root:# attrib 获得 doc 的属性doc_attr = doc.attrib print(doc_attr) # {'ID': '4'}# 遍历doc 中的子元素for sent in doc:sent_attr = sent.attribprint(sent_attr) # {'ID': '1', 'label': '2'}# 获得正文text = sent.textprint(text) #转发了财新网的微博:【内鬼与大鳄姚刚张育军的唏嘘人生】...

解析过程 非常简单,主要是三个点

  1. 直接使用 in 一层一层 遍历
  2. element.attrib 获得 对应元素的属性
  3. element.text 获得正文

 

这篇关于python 使用 xml.etree.ElementTree 解析 xml的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/934

相关文章

C语言中联合体union的使用

本文编辑整理自: http://bbs.chinaunix.net/forum.php?mod=viewthread&tid=179471 一、前言 “联合体”(union)与“结构体”(struct)有一些相似之处。但两者有本质上的不同。在结构体中,各成员有各自的内存空间, 一个结构变量的总长度是各成员长度之和。而在“联合”中,各成员共享一段内存空间, 一个联合变量

Tolua使用笔记(上)

目录   1.准备工作 2.运行例子 01.HelloWorld:在C#中,创建和销毁Lua虚拟机 和 简单调用。 02.ScriptsFromFile:在C#中,对一个lua文件的执行调用 03.CallLuaFunction:在C#中,对lua函数的操作 04.AccessingLuaVariables:在C#中,对lua变量的操作 05.LuaCoroutine:在Lua中,

解析 XML 和 INI

XML 1.TinyXML库 TinyXML是一个C++的XML解析库  使用介绍: https://www.cnblogs.com/mythou/archive/2011/11/27/2265169.html    使用的时候,只要把 tinyxml.h、tinystr.h、tinystr.cpp、tinyxml.cpp、tinyxmlerror.cpp、tinyxmlparser.

Vim使用基础篇

本文内容大部分来自 vimtutor,自带的教程的总结。在终端输入vimtutor 即可进入教程。 先总结一下,然后再分别介绍正常模式,插入模式,和可视模式三种模式下的命令。 目录 看完以后的汇总 1.正常模式(Normal模式) 1.移动光标 2.删除 3.【:】输入符 4.撤销 5.替换 6.重复命令【. ; ,】 7.复制粘贴 8.缩进 2.插入模式 INSERT

Lipowerline5.0 雷达电力应用软件下载使用

1.配网数据处理分析 针对配网线路点云数据,优化了分类算法,支持杆塔、导线、交跨线、建筑物、地面点和其他线路的自动分类;一键生成危险点报告和交跨报告;还能生成点云数据采集航线和自主巡检航线。 获取软件安装包联系邮箱:2895356150@qq.com,资源源于网络,本介绍用于学习使用,如有侵权请您联系删除! 2.新增快速版,简洁易上手 支持快速版和专业版切换使用,快速版界面简洁,保留主

如何免费的去使用connectedpapers?

免费使用connectedpapers 1. 打开谷歌浏览器2. 按住ctrl+shift+N,进入无痕模式3. 不需要登录(也就是访客模式)4. 两次用完,关闭无痕模式(继续重复步骤 2 - 4) 1. 打开谷歌浏览器 2. 按住ctrl+shift+N,进入无痕模式 输入网址:https://www.connectedpapers.com/ 3. 不需要登录(也就是

Python 字符串占位

在Python中,可以使用字符串的格式化方法来实现字符串的占位。常见的方法有百分号操作符 % 以及 str.format() 方法 百分号操作符 % name = "张三"age = 20message = "我叫%s,今年%d岁。" % (name, age)print(message) # 我叫张三,今年20岁。 str.format() 方法 name = "张三"age

Toolbar+DrawerLayout使用详情结合网络各大神

最近也想搞下toolbar+drawerlayout的使用。结合网络上各大神的杰作,我把大部分的内容效果都完成了遍。现在记录下各个功能效果的实现以及一些细节注意点。 这图弹出两个菜单内容都是仿QQ界面的选项。左边一个是drawerlayout的弹窗。右边是toolbar的popup弹窗。 开始实现步骤详情: 1.创建toolbar布局跟drawerlayout布局 <?xml vers

一道经典Python程序样例带你飞速掌握Python的字典和列表

Python中的列表(list)和字典(dict)是两种常用的数据结构,它们在数据组织和存储方面有很大的不同。 列表(List) 列表是Python中的一种有序集合,可以随时添加和删除其中的元素。列表中的元素可以是任何数据类型,包括数字、字符串、其他列表等。列表使用方括号[]表示,元素之间用逗号,分隔。 定义和使用 # 定义一个列表 fruits = ['apple', 'banana

Python应用开发——30天学习Streamlit Python包进行APP的构建(9)

st.area_chart 显示区域图。 这是围绕 st.altair_chart 的语法糖。主要区别在于该命令使用数据自身的列和指数来计算图表的 Altair 规格。因此,在许多 "只需绘制此图 "的情况下,该命令更易于使用,但可定制性较差。 如果 st.area_chart 无法正确猜测数据规格,请尝试使用 st.altair_chart 指定所需的图表。 Function signa