- xml - AJAX/Jquery XML 解析
- 具有多重继承的 XML 模式
- .net - 枚举序列化 Json 与 XML
- XML 简单类型、简单内容、复杂类型、复杂内容
Latitude :23.1100348
Longitude:72.5364922
date&time :30:August:2014 05:04:31 PM
gsm cell id: 4993
Neighboring List- Lac : Cid : RSSI
15000 : 7072 : 25 dBm
15000 : 7073 : 23 dBm
15000 : 6102 : 24 dBm
15000 : 6101 : 24 dBm
15000 : 6103 : 17 dBm
Latitude :23.1120549
Longitude:72.5397988
date&time :30:August:2014 05:04:34 PM
gsm cell id: 4993
Neighboring List- Lac : Cid : RSSI
15000 : 7072 : 24 dBm
15000 : 7073 : 22 dBm
15000 : 6102 : 23 dBm
15000 : 6101 : 23 dBm
15000 : 2552 : 16 dBm
这是我的.txt文件,我想把它转换成类似xml的文件
<celldata>
<time> </time>
<latitude> </latitude>
<longitude> </longitude>
</celldata>
我试图列出所有组件,但没有得到 o/p。我想在列表中存储纬度、经度、gsm 单元 ID、时间的所有值,这将在 xml 文件中添加类似的内容。我写下面的代码。
import re
pa = 'Longitude|Latitude|gsm cell id|Neighboring List- Lac : Cid : RSSI'
with open('cell.txt','rw') as file:
for line in file:
line.strip()
if re.search(pa, line):
lineInfo = line.split(':')
title = lineInfo[0]
value = lineInfo[1]
最佳答案
首先尝试使用以下代码:
#!python3
import re
import xml.etree.ElementTree as ET
rex = re.compile(r'''(?P<title>Longitude
|Latitude
|date&time
|gsm\s+cell\s+id
)
\s*:?\s*
(?P<value>.*)
''', re.VERBOSE)
root = ET.Element('root')
root.text = '\n' # newline before the celldata element
with open('cell.txt') as f:
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n' # newline before the collected element
celldata.tail = '\n\n' # empty line after the celldata element
for line in f:
# Empty line starts new celldata element (hack style, uggly)
if line.isspace():
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n'
celldata.tail = '\n\n'
# If the line contains the wanted data, process it.
m = rex.search(line)
if m:
# Fix some problems with the title as it will be used
# as the tag name.
title = m.group('title')
title = title.replace('&', '')
title = title.replace(' ', '')
e = ET.SubElement(celldata, title.lower())
e.text = m.group('value')
e.tail = '\n'
# Display for debugging
ET.dump(root)
# Include the root element to the tree and write the tree
# to the file.
tree = ET.ElementTree(root)
tree.write('cell.xml', encoding='utf-8', xml_declaration=True)
它显示您的示例数据:
<root>
<celldata>
<latitude>23.1100348</latitude>
<longitude>72.5364922</longitude>
<datetime>30:August:2014 05:04:31 PM</datetime>
<gsmcellid>4993</gsmcellid>
</celldata>
<celldata>
<latitude>23.1120549</latitude>
<longitude>72.5397988</longitude>
<datetime>30:August:2014 05:04:34 PM</datetime>
<gsmcellid>4993</gsmcellid>
</celldata>
</root>
通缉邻居列表更新:
#!python3
import re
import xml.etree.ElementTree as ET
rex = re.compile(r'''(?P<title>Longitude
|Latitude
|date&time
|gsm\s+cell\s+id
|Neighboring\s+List-\s+Lac\s+:\s+Cid\s+:\s+RSSI
)
\s*:?\s*
(?P<value>.*)
''', re.VERBOSE)
root = ET.Element('root')
root.text = '\n' # newline before the celldata element
with open('cell.txt') as f:
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n' # newline before the collected element
celldata.tail = '\n\n' # empty line after the celldata element
for line in f:
# Empty line starts new celldata element (hack style, uggly)
if line.isspace():
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n'
celldata.tail = '\n\n'
else:
# If the line contains the wanted data, process it.
m = rex.search(line)
if m:
# Fix some problems with the title as it will be used
# as the tag name.
title = m.group('title')
title = title.replace('&', '')
title = title.replace(' ', '')
if line.startswith('Neighboring'):
neighbours = ET.SubElement(celldata, 'neighbours')
neighbours.text = '\n'
neighbours.tail = '\n'
else:
e = ET.SubElement(celldata, title.lower())
e.text = m.group('value')
e.tail = '\n'
else:
# This is the neighbour item. Split it by colon,
# and set the attributes of the item element.
item = ET.SubElement(neighbours, 'item')
item.tail = '\n'
lac, cid, rssi = (a.strip() for a in line.split(':'))
item.attrib['lac'] = lac
item.attrib['cid'] = cid
item.attrib['rssi'] = rssi.split()[0] # dBm removed
# Include the root element to the tree and write the tree
# to the file.
tree = ET.ElementTree(root)
tree.write('cell.xml', encoding='utf-8', xml_declaration=True)
接受邻居之前的空行的更新——也为一般目的更好地实现:
#!python3
import re
import xml.etree.ElementTree as ET
rex = re.compile(r'''(?P<title>Longitude
|Latitude
|date&time
|gsm\s+cell\s+id
|Neighboring\s+List-\s+Lac\s+:\s+Cid\s+:\s+RSSI
)
\s*:?\s*
(?P<value>.*)
''', re.VERBOSE)
root = ET.Element('root')
root.text = '\n' # newline before the celldata element
with open('cell.txt') as f:
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n' # newline before the collected element
celldata.tail = '\n\n' # empty line after the celldata element
status = 0 # init status of the finite automaton
for line in f:
if status == 0: # lines of the heading expected
# If the line contains the wanted data, process it.
m = rex.search(line)
if m:
# Fix some problems with the title as it will be used
# as the tag name.
title = m.group('title')
title = title.replace('&', '')
title = title.replace(' ', '')
if line.startswith('Neighboring'):
neighbours = ET.SubElement(celldata, 'neighbours')
neighbours.text = '\n'
neighbours.tail = '\n'
status = 1 # empty line and then list of neighbours expected
else:
e = ET.SubElement(celldata, title.lower())
e.text = m.group('value')
e.tail = '\n'
# keep the same status
elif status == 1: # empty line expected
if line.isspace():
status = 2 # list of neighbours must follow
else:
raise RuntimeError('Empty line expected. (status == {})'.format(status))
status = 999 # error status
elif status == 2: # neighbour or the empty line as final separator
if line.isspace():
celldata = ET.SubElement(root, 'celldata')
celldata.text = '\n'
celldata.tail = '\n\n'
status = 0 # go to the initial status
else:
# This is the neighbour item. Split it by colon,
# and set the attributes of the item element.
item = ET.SubElement(neighbours, 'item')
item.tail = '\n'
lac, cid, rssi = (a.strip() for a in line.split(':'))
item.attrib['lac'] = lac
item.attrib['cid'] = cid
item.attrib['rssi'] = rssi.split()[0] # dBm removed
# keep the same status
elif status == 999: # error status -- break the loop
break
else:
raise LogicError('Unexpected status {}.'.format(status))
break
# Display for debugging
ET.dump(root)
# Include the root element to the tree and write the tree
# to the file.
tree = ET.ElementTree(root)
tree.write('cell.xml', encoding='utf-8', xml_declaration=True)
代码实现了所谓的有限自动机,其中status
变量表示其当前状态。您可以使用铅笔和纸将其形象化——在内部绘制带有状态编号的小圆圈(在图论中称为节点)。在这种状态下,您只允许某种输入(行
)。当输入被识别时,您将箭头(图论中的定向边)绘制到另一个状态(可能是相同的状态,作为返回同一节点的循环)。箭头注释为`condition |行动”。
结果一开始可能看起来很复杂;但是,从某种意义上说,您始终可以专注于属于特定状态的代码部分,这很容易。而且,代码可以很容易地修改。然而,有限自动机的功率有限。但它们非常适合解决此类问题。
关于python - 如何使用 python 将 .txt 文件转换为 xml 文件?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/26056316/
我正在处理一组标记为 160 个组的 173k 点。我想通过合并最接近的(到 9 或 10 个组)来减少组/集群的数量。我搜索过 sklearn 或类似的库,但没有成功。 我猜它只是通过 knn 聚类
我有一个扁平数字列表,这些数字逻辑上以 3 为一组,其中每个三元组是 (number, __ignored, flag[0 or 1]),例如: [7,56,1, 8,0,0, 2,0,0, 6,1,
我正在使用 pipenv 来管理我的包。我想编写一个 python 脚本来调用另一个使用不同虚拟环境(VE)的 python 脚本。 如何运行使用 VE1 的 python 脚本 1 并调用另一个 p
假设我有一个文件 script.py 位于 path = "foo/bar/script.py"。我正在寻找一种在 Python 中通过函数 execute_script() 从我的主要 Python
这听起来像是谜语或笑话,但实际上我还没有找到这个问题的答案。 问题到底是什么? 我想运行 2 个脚本。在第一个脚本中,我调用另一个脚本,但我希望它们继续并行,而不是在两个单独的线程中。主要是我不希望第
我有一个带有 python 2.5.5 的软件。我想发送一个命令,该命令将在 python 2.7.5 中启动一个脚本,然后继续执行该脚本。 我试过用 #!python2.7.5 和http://re
我在 python 命令行(使用 python 2.7)中,并尝试运行 Python 脚本。我的操作系统是 Windows 7。我已将我的目录设置为包含我所有脚本的文件夹,使用: os.chdir("
剧透:部分解决(见最后)。 以下是使用 Python 嵌入的代码示例: #include int main(int argc, char** argv) { Py_SetPythonHome
假设我有以下列表,对应于及时的股票价格: prices = [1, 3, 7, 10, 9, 8, 5, 3, 6, 8, 12, 9, 6, 10, 13, 8, 4, 11] 我想确定以下总体上最
所以我试图在选择某个单选按钮时更改此框架的背景。 我的框架位于一个类中,并且单选按钮的功能位于该类之外。 (这样我就可以在所有其他框架上调用它们。) 问题是每当我选择单选按钮时都会出现以下错误: co
我正在尝试将字符串与 python 中的正则表达式进行比较,如下所示, #!/usr/bin/env python3 import re str1 = "Expecting property name
考虑以下原型(prototype) Boost.Python 模块,该模块从单独的 C++ 头文件中引入类“D”。 /* file: a/b.cpp */ BOOST_PYTHON_MODULE(c)
如何编写一个程序来“识别函数调用的行号?” python 检查模块提供了定位行号的选项,但是, def di(): return inspect.currentframe().f_back.f_l
我已经使用 macports 安装了 Python 2.7,并且由于我的 $PATH 变量,这就是我输入 $ python 时得到的变量。然而,virtualenv 默认使用 Python 2.6,除
我只想问如何加快 python 上的 re.search 速度。 我有一个很长的字符串行,长度为 176861(即带有一些符号的字母数字字符),我使用此函数测试了该行以进行研究: def getExe
list1= [u'%app%%General%%Council%', u'%people%', u'%people%%Regional%%Council%%Mandate%', u'%ppp%%Ge
这个问题在这里已经有了答案: Is it Pythonic to use list comprehensions for just side effects? (7 个答案) 关闭 4 个月前。 告
我想用 Python 将两个列表组合成一个列表,方法如下: a = [1,1,1,2,2,2,3,3,3,3] b= ["Sun", "is", "bright", "June","and" ,"Ju
我正在运行带有最新 Boost 发行版 (1.55.0) 的 Mac OS X 10.8.4 (Darwin 12.4.0)。我正在按照说明 here构建包含在我的发行版中的教程 Boost-Pyth
学习 Python,我正在尝试制作一个没有任何第 3 方库的网络抓取工具,这样过程对我来说并没有简化,而且我知道我在做什么。我浏览了一些在线资源,但所有这些都让我对某些事情感到困惑。 html 看起来
我是一名优秀的程序员,十分优秀!