对于我的情况,我必须在XML文件中找到一些元素,并使用text
属性更新它们的值。为此,我必须搜索xml元素A、B和C。我的项目使用xml.etree和python语言。目前我正在使用:
self.get_root.findall(H/A/T)
self.get_root.findall(H/B/T)
self.get_root.findall(H/C/T)
示例XML文件:
<H><A><T>text-i-have-to-update</H></A></T>
<H><B><T>text-i-have-to-update</H></B></T>
<H><C><T>text-i-have-to-update</H></C></T>
正如我们所注意到的,只有路径中的中间元素是不同的。有没有一种方法可以使用类似self.get_root.findall(H|(A,B,C)|T)
的东西来优化代码?任何正确方向的指导都可以!谢谢
我经历了类似的问题:XPath选择多个标签,但它不适用于我的案例
更新:可能是findall((中的正则表达式?
问题中的html格式错误;假设它的格式正确(如下(,试试这个:
import xml.etree.ElementTree as ET
data = """<root>
<H><A><T>text-i-have-to-update</T></A></H>
<H><B><T>text-i-have-to-update</T></B></H>
<H><C><T>text-i-have-to-update</T></C></H>
</root>"""
doc = ET.fromstring(data)
for item in doc.findall('.//H//T'):
item.text = "modified text"
print(ET.tostring(doc).decode())
输出:
<root>
<H><A><T>modified text</T></A></H>
<H><B><T>modified text</T></B></H>
<H><C><T>modified text</T></C></H>
</root>