Python lxml - 使用 xml :lang attribute to retrieve an element-6ren

Python lxml - 使用 xml :lang attribute to retrieve an element

转载作者：太空宇宙更新时间：2023-11-04 03:30:31

26

4

我有一些 xml，其中包含多个同名元素，但每个元素使用不同的语言，例如:

<Title xml:lang="FR" type="main">Les Tudors</Title>
<Title xml:lang="DE" type="main">Die Tudors</Title>
<Title xml:lang="IT" type="main">The Tudors</Title>

通常，我会使用如下属性检索元素:

titlex = info.find('.//xmlns:Title[@someattribute=attributevalue]', namespaces=nsmap)

如果我尝试使用 [@xml:lang="FR"] 执行此操作(例如)，我会收到回溯错误:

  File "D:/Python code/RBM CRID, Title, Genre/CRID, Title, Genre, Age rating, Episode Number, Descriptions V1.py", line 29, in <module>
    titlex = info.find('.//xmlns:Title[@xml:lang=PL]', namespaces=nsmap) 

  File "lxml.etree.pyx", line 1457, in lxml.etree._Element.find (src\lxml\lxml.etree.c:51435)

  File "C:\Python34\lib\site-packages\lxml\_elementpath.py", line 282, in find
    it = iterfind(elem, path, namespaces)

  File "C:\Python34\lib\site-packages\lxml\_elementpath.py", line 272, in iterfind
    selector = _build_path_iterator(path, namespaces)

  File "C:\Python34\lib\site-packages\lxml\_elementpath.py", line 256, in _build_path_iterator
    selector.append(ops[token[0]](_next, token))

  File "C:\Python34\lib\site-packages\lxml\_elementpath.py", line 134, in prepare_predicate
    token = next()

  File "C:\Python34\lib\site-packages\lxml\_elementpath.py", line 80, in xpath_tokenizer
    raise SyntaxError("prefix %r not found in prefix map" % prefix) SyntaxError: prefix 'xml' not found in prefix map

我对此并不感到惊讶，但我想要有关如何解决该问题的建议。

谢谢!

根据要求，一个精简但完整的代码集(如果我删除 [bitsinsquarebrackets]，它会按预期工作):

import lxml
import codecs

file_name = (input('Enter the file name, excluding .xml extension: ') + '.xml')# User inputs file name
print('Parsing ' + file_name)


#----- Sets up import and namespace

from lxml import etree

parser = lxml.etree.XMLParser()


tree = lxml.etree.parse(file_name, parser)                                 # Name of file to test goes here
root = tree.getroot()

nsmap = {'xmlns': 'urn:tva:metadata:2012',
         'mpeg7': 'urn:tva:mpeg7:2008'}

#----- This code writes the output to a file

with codecs.open(file_name+'.log', mode='w', encoding='utf-8') as f:                        # Name the output file
    f.write(u'CRID|Title|Genre|Rating|Short Synopsis|Medium Synopsis|Long Synopsis\n')
    for info in root.xpath('//xmlns:ProgramInformation', namespaces=nsmap):
       titlex = info.find('.//xmlns:Title[xml:lang="PL"]', namespaces=nsmap)             # Retreve the title
       title = titlex.text if titlex != None else 'Missing'             # If there isn't a title, print an alternative word
       f.write(u'{}\n'.format(title))                     # Write all the retrieved values to the same line with bar seperators and a new line

最佳答案

xml:lang中的xml前缀不需要在XML文档中声明，但是如果要使用xml:lang 在 XPath 查找中，您必须在 Python 代码中定义前缀映射。

xml 前缀是保留的(与任意的“普通” namespace 前缀相反)并定义为绑定(bind)到 http://www.w3.org/XML/1998/命名空间。查看Namespaces in XML 1.0 W3C 推荐。

例子:

from lxml import etree

# Required mapping
nsmap = {"xml": "http://www.w3.org/XML/1998/namespace"}
 
XML = """
<root>
  <Title xml:lang="FR" type="main">Les Tudors</Title>
  <Title xml:lang="DE" type="main">Die Tudors</Title>
  <Title xml:lang="IT" type="main">The Tudors</Title>
</root>"""
 
doc = etree.fromstring(XML)
 
title_FR = doc.find('Title[@xml:lang="FR"]', namespaces=nsmap)
print(title_FR.text)

输出:

Les Tudors

如果 xml 前缀没有映射，您将收到“前缀映射中未找到前缀‘xml’”错误。如果映射到 xml 前缀的 URI 不是 http://www.w3.org/XML/1998/namespace，则 find 方法上面的代码片段中不返回任何内容。

关于Python lxml - 使用 xml :lang attribute to retrieve an element，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/31250641/

26

4

0

文章推荐： html - 如何禁用超链接和提交表单的所有操作但可以拖动这些元素

文章推荐： javascript - 加载 fontawesome 的回退计划

文章推荐： python - 基于 uwsgi 监听队列的 AWS 自动缩放

xml - 如何在没有源 xml 文件根节点的情况下将一个 xml 文件包含在另一个 xml 中？
正如标题中所问，我有两个如下结构的 XML 文件 A.xml //here I want to include B.xml
c# - 如何将等 xml 标签格式更改为
我有一个 xml 文件。根据我的要求，我需要更新空标签，例如我需要更改 to .是否可以像那样更改标签.. 谢谢... 最佳答案 var xmlString=" "; var properStri
xml - Golang : get inner xml from xml with xml.解码
我有这样简单的 XML: Song Playing 09:41:18 Frederic Delius Violin Son
xml - XML 阅读器是否应该忽略 XML 文件中的连续空格？
在我的工作中，我们有自己的 XML 类来构建 DOM，但我不确定应该如何处理连续的空格？例如 Hello World 当它被读入 DOM 时，文本节点应该包含 Hello 和 World
xml - 比较来自不同 XML 文件的元素值并附加到第一个 XML
我有以下 2 个 xml 文件，我必须通过比较 wd:Task_Name_ID 和 TaskID 的 XML 文件 2。例如，Main XML File-1 wd:Task_Name_ID 具有以下
xml - 使 XML 构建器从字符串中插入 XML
我在 Rails 应用程序中有一个 XML View ，需要从另一个文件插入 XML 以进行测试。我想说“构建器，只需盲目地填充这个字符串，因为它已经是 xml”，但我在文档中看不到这样做的任何内容
xml - XML 数据和 XML 元数据之间有什么区别？
我正在重建一些 XML 提要，因此我正在研究何时使用元素以及何时使用带有 XML 的属性。一些网站说“数据在元素中，元数据在属性中。” 那么，两者有什么区别呢？让我们以 W3Schools 为例:
xml - 文档中的多个 XML 声明是否为格式正确的 XML？
在同一个文档中有两个 XML 声明是否是格式正确的 XML？ hello 我相信不是，但是我找不到支持我的消息来源。来自 Extensible Markup Language
xml - 在 XML 中包装任意 XML
我需要在包装器 XML 文档中嵌入任意(语法上有效的)XML 文档。嵌入式文档被视为纯文本，在解析包装文档时不需要可解析。我知道“CDATA trick”，但如果内部 XML 文档本身包含 CDAT
xml - XML 解析器和 XML 处理器是否相同？
XML 解析器和 XML 处理器是两个不同的东西吗？他们是两个不同的工作吗？最佳答案 XML 解析器和 XML 处理器是一样的。它不适用于其他语言。 XML 是通用数据标记语言。解析 XML 文件已
xml - 在保留格式的同时从文件读取 XML 和从文件读取 XML
我使用这个 perl 代码从一个文件中读取 XML，然后写入另一个文件(我的完整脚本有添加属性的代码): #!usr/bin/perl -w use strict; use XML::DOM; use
xml - 使用 PowerShell 将 system.xml.xml 元素转换为 system.xml.xml 文档
我正在编写一个我了解有限的历史脚本。对象 A 的类型为 system.xml.xmlelement，我需要将其转换为类型 system.xml.xmldocument 以与对象 B 进行比较(类型
xml - 如何将子节点结构从一个 XML 文件复制到另一个 XML 文件(合并两个 XML 文件)？
我有以下两个 XML 文件: 文件1 101 102 103 501 502 503
xml - 如何将子节点结构从一个 XML 文件复制到另一个 XML 文件(合并两个 XML 文件)？
我有以下两个 XML 文件: 文件1 101 102 103 501 502 503
java - 转换性能 XML>XSL>XML 与 XML>JAXB>XML
我有一个案例，其中一个 xml 作为输入，另一个 xml 作为输出:我可以选择使用 XSL 和通过 JAXB 进行 Unmarshalling 编码。性能方面，有什么真正的区别吗？最佳答案首先，程
java - 从 XML 元素获取 XML 时的标签顺序(XML 包含 XML)？
我有包含 XML 的 XML，我想使用 JAXB 解析它 qwqweqwezxcasdasd eee 解析器 public static NotificationRequest parse(Strin
xml - 无法使用 XML 架构和 Perl (XML::LibXML) 验证 XML
xml: mario de2f15d014d40b93578d255e6221fd60 Mario F 23 maria maria
java.net.MalformedURLException : no protocol: [c:\XML\file. xml，c :\XML\file2. xml，c :\XML\file3. xml]
尝试更新 xml 文件数组时出现以下错误。代码片段: File dir = new File("c:\\XML"); File[] files = dir.listFiles(new Filenam
xml - 如何使用 ConvertTo-Xml 和 Select-Xml 加载或读取 XML 文件？
我怎样才能完成这样的事情: PS /home/nicholas/powershell> PS /home/nicholas/powershell> $date=(Get-Date | ConvertT
xml - 删除 XML 节点以将 XML 日志文件的大小减小到给定大小
我在从 xml 文件中删除节点时遇到一些困难。我发现很多其他人通过各种方式在 powershell 中执行此操作的示例，下面的代码似乎与我见过的许多其他示例相同，但我没有得到所需的行为。我的目标是将

首页

博学

6Ren·AI

商城

Python lxml - 使用 xml :lang attribute to retrieve an element