- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
Pandas 有 pandas.io.json.json_normalize
可以扁平化json的方法。
我有一个包含 json-per-line 数据的源文件(通过长时间运行的进程流式传输到文件)。我真的无法修改写入该文件的内容。这是一个人为的 JSON 示例:{"type": "bar", "aspect": {"Positive": 1, "Negative": 0.6}}
{"type": "bar", "aspect": {"Positive": 0.6, "Negative": 1.5}}
我可以使用普通的 pandas.read_json
阅读它方法通过传递 lines=True
范围。但是我希望它被扁平化,就像通过 json_normalize 一样,因为这使它成为一个非常有用的形式,例如>>> json_normalize(json.loads('{"type": "bar", "aspect": {"Positive": 1, "Negative": 0.6}}'))
aspect.Negative aspect.Positive type
0 0.6 1 bar
如果我循环遍历源代码、规范化和附加,这将导致我添加的每一行都有一个完整的副本。这真的会损害性能。
最佳答案
您可以使用 read_json
+ DataFrame constructor
+ add_prefix
+ drop
+ join
:
df = pd.read_json('file.json', lines = True)
print (df)
aspect type
0 {'Negative': 0.6000000000000001, 'Positive': 1} bar
1 {'Negative': 1.5, 'Positive': 0.6000000000000001} bar
df = (pd.DataFrame(df['aspect'].values.tolist())
.add_prefix('aspect.')
.join(df.drop('aspect', 1)))
print (df)
aspect.Negative aspect.Positive type
0 0.6 1.0 bar
1 1.5 0.6 bar
json.loads
和上次使用
json_normalize
:
df = json_normalize(pd.Series(open('file.json').readlines()).apply(json.loads))
print (df)
aspect.Negative aspect.Positive type
0 0.6 1.0 bar
1 1.5 0.6 bar
df = json_normalize([json.loads(x) for x in open('file.json').readlines()])
print (df)
aspect.Negative aspect.Positive type
0 0.6 1.0 bar
1 1.5 0.6 bar
In [13]: %timeit json_normalize([json.loads(x) for x in open('file.json').readlines()])
10 loops, best of 3: 112 ms per loop
In [14]: %timeit json_normalize(pd.Series(open('file.json').readlines()).apply(json.loads))
10 loops, best of 3: 117 ms per loop
In [15]: %%timeit
...: df = pd.read_json('file.json', lines = True)
...: df = (pd.DataFrame(df['aspect'].values.tolist()).add_prefix('aspect.').join(df.drop('aspect', 1)))
...:
10 loops, best of 3: 30.1 ms per loop
关于python - Pandas ,规范化 json-per-line,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/46481764/
当前问题陈述的输入是 - 输入.txt #START_OF_TEST_CASES #DATA key1:VA1 key2:VA2 key3:VA3 key4:VA4 key5:VA5 #DEND #E
编辑:添加了 PDO 调用。 这是实际的错误: Notice: Object of class PDOStatement could not be converted to int in Unknow
“git diff --stat”和“git log --stat”显示如下输出: $ git diff -C --stat HEAD c9af3e6136e8aec1f79368c2a6164e56
我有一个具有以下格式的输入文件:安大略省:布兰普顿:北纬 43° 41':西经 79° 45'安大略省:多伦多:北纬 43° 39':西经 79° 23'魁北克省:蒙特利尔:北纬 45° 30':西经
空白行仅包含\n或\r\n或\r。 tempfile = open(file,"r") for id,line in enumerate(tempfile): if(line != "\n"
我尝试使用 BABYLON.js 开发棋盘游戏我有一个板子和一个 ArcRotateCamera。 我的灯是 HemisphericLight 当我在板上画线时,我希望这些线具有相同的外观。现在,当我
我尝试使用 BABYLON.js 开发棋盘游戏我有一个板子和一个 ArcRotateCamera。 我的灯是 HemisphericLight 当我在板上画线时,我希望这些线具有相同的外观。现在,当我
有一个while read循环: while read line; do grep "^$line" file1 done < target 我应该使用 "^$line" 来获得正确答案。我想
我有一个我无法解决的 numpy 问题。我有填充 0 和 1 的 3D 数组 (x,y,z)。例如,z 轴上的一个切片: array([[1, 0, 1, 0, 1, 1, 0, 0],
作为临时方法,我使用 .txt 文件来存储程序的某些变量。写入与 fs.appendFile 完美配合,但考虑到它的大小,使用 fs.readFile 读取不合适 - 我想得到某一行 来自文件,以及
我试图找到一种通过R studio进行调试的方法,但是我发现的所有解决方案都无法真正起作用。 1.)CTRL + enter:有效,但不会通过循环的每次迭代,而只能执行一次。 2.)添加“browse
在我的应用程序中,我的 EditText 左侧有行号 - 到目前为止一切都很好,行号与 EditText 的行完全对齐。 问题是,如果用户更改 EditText 的文本大小,则行号无法正确对齐。所以我
通过使用 + 的参数调用它,我可以使 vim 将光标定位在文件的最后一行。 : vi + myfile # "+" = go to last line of file 我怎样才能做到
我已经在文件中写入了这样的数据(某种) {:a 25 :b 28} {:a 2 :b 50} ... 我想要这些 map 的惰性序列。 大约有 4000 万行。我也可以写 10000 的 block
我在文本区域中发现了一个奇怪的错误(?)... 比如说,有一个 使用多行文本(用户粘贴的文本或预设文本无关紧要,两者都经过测试)。 我想从 中获取文本并替换 \n与其他东西......结果是,.re
我需要一个新行,这样我就可以在 PFD 中看到一个格式,我尝试添加一个页面宽度但它没有用,我用另一个东西/n 也没有用。这是我的代码。我可以手动添加格式,因为我需要显示从数据库中获取的信息,并且我在一
我正在尝试编写一个 Java 程序,它将大量 GPS 坐标捕捉到线形文件(道路网络),并且不仅返回新坐标,还返回捕捉到的线段的唯一标识符。该标识符是否是 FID、其他语言中使用的“索引”(即,其中 1
你好,我正在努力处理 JavaScript/NodeJS 中的数组。 基本上,这是我的代码: let arr = new Array(); arr = { "Username" : var1,
我正在学习 matplotlib 的基本教程,我正在处理的示例代码是: import numpy as np import matplotlib.pylab as plt x=[1,2,3,4] y=
所以,假设我有一个包含 20 行的文本文件,每行都有不同的文本。我希望能够有一个包含第一行的字符串,但是当我执行 NextLine(); 时我希望它成为下一行。我试过了,但它似乎不起作用: strin
我是一名优秀的程序员,十分优秀!