python - 使用 numpy 和 matplotlib 的总和直方图而不是计数-6ren

python - 使用 numpy 和 matplotlib 的总和直方图而不是计数

转载作者：太空狗更新时间：2023-10-29 23:59:06

24

4

我有一些数据，每行有两列。以我为例，工作提交时间和地区。

我使用 matplotlib 的 hist 函数生成了一个图表，其中时间在 x 轴上按天分箱，在 y 轴上按天计数:

import numpy as np
import matplotlib.pyplot as plt
import matplotlib as mpl
import datetime as dt

def timestamp_to_mpl(timestamp):
    return mpl.dates.date2num(dt.datetime.fromtimestamp(timestamp))

nci_file_name = 'out/nci.csv'
jobs = np.genfromtxt(nci_file_name, dtype=int, delimiter=',', names=True, usecols(1,2,3,4,5))

fig, ax = plt.subplots(2, 1, sharex=True)
vect_timestamp_to_mpl = np.vectorize(timestamp_to_mpl)
qtime = vect_timestamp_to_mpl(jobs['queued_time'])
start_date = dt.datetime(2013, 1, 1)
end_date = dt.datetime(2013, 4, 1)
bins = mpl.dates.drange(start_date, end_date, dt.timedelta(days=1))
ax[0].hist(qtime[jobs['charge_rate']==1], bins=bins, label='Normal', color='b')
ax[1].hist(qtime[jobs['charge_rate']==3], bins=bins, label='Express', color='g')
ax[0].grid(True)
ax[1].grid(True)
fig.suptitle('NCI Workload Submission Daily Rate')
ax[0].set_title('Normal Queue')
ax[1].set_title('Express Queue')
ax[1].xaxis.set_major_locator(mpl.dates.AutoDateLocator())
ax[1].xaxis.set_major_formatter(mpl.dates.AutoDateFormatter(ax[1].xaxis.get_major_locator()))
ax[1].set_xlim(mpl.dates.date2num(start_date), mpl.dates.date2num(end_date))
plt.setp(ax[1].xaxis.get_majorticklabels(), rotation=25, ha='right')
ax[1].set_xlabel('Date')
ax[0].set_ylabel('Jobs per Day')
ax[1].set_ylabel('Jobs per Day')
fig.savefig('out/figs/nci_sub_rate_day_sub.png')
plt.show()

NCI Workload Submission Daily Rate

我现在想要一个图表，x 轴上按天划分时间，y 轴上按 bin 面积求和。

到目前为止，我是使用列表推导式得出这个结论的:

import numpy as np
import matplotlib.pyplot as plt
import matplotlib as mpl
import datetime as dt

def timestamp_to_mpl(timestamp):
    return mpl.dates.date2num(dt.datetime.fromtimestamp(timestamp))

def binsum(bin_by, sum_by, bins):
    bin_index = np.digitize(bin_by, bins)
    sums = [np.sum(sum_by[bin_index==i]) for i in range(len(bins))]
    return sums

fig, ax = plt.subplots(2, 1, sharex=True)
vect_timestamp_to_mpl = np.vectorize(timestamp_to_mpl)
qtime = vect_timestamp_to_mpl(jobs['queued_time'])
area = jobs['run_time'] * jobs['req_procs']
start_date = dt.datetime(2013, 1, 1)
end_date = dt.datetime(2013, 4, 1)
delta = dt.timedelta(days=1)
bins = mpl.dates.drange(start_date, end_date, delta)
sums_norm = binsum(qtime[jobs['charge_rate']==1], area[jobs['charge_rate']==1], bins)
sums_expr = binsum(qtime[jobs['charge_rate']==3], area[jobs['charge_rate']==3], bins)
ax[0].bar(bins, sums_norm, width=1.0, label='Normal', color='b')
ax[1].bar(bins, sums_expr, width=1.0, label='Express', color='g')
ax[0].grid(True)
ax[1].grid(True)
fig.suptitle('NCI Workload Area Daily Rate')
ax[0].set_title('Normal Queue')
ax[1].set_title('Express Queue')
ax[1].xaxis.set_major_locator(mpl.dates.AutoDateLocator())
ax[1].xaxis.set_major_formatter(mpl.dates.AutoDateFormatter(ax[1].xaxis.get_major_locator()))
ax[1].set_xlim(mpl.dates.date2num(start_date), mpl.dates.date2num(end_date))
plt.setp(ax[1].xaxis.get_majorticklabels(), rotation=25, ha='right')
ax[1].set_xlabel('Date')
ax[0].set_ylabel('Area per Day')
ax[1].set_ylabel('Area per Day')
fig.savefig('out/figs/nci_area_day_sub.png')
plt.show()

NCI Workload Area Daily Rate

我还是 NumPy 的新手，想知道我是否可以改进:

def binsum(bin_by, sum_by, bins):
    bin_index = np.digitize(bin_by, bins)
    sums = [np.sum(sum_by[bin_index==i]) for i in range(len(bins))]
    return sums

所以它不使用 Python 列表。

是否有可能以某种方式分解 sum_by[bin_index==i] 以便我得到一个长度为 len(bins) 的数组？然后 np.sum() 将返回一个 numpy 数组。

最佳答案

Matplotlib 的 hist函数和 NumPy 的 histogram函数有一个 weights 可选关键字参数。我认为您的第一个代码中唯一需要更改的相关行最终应该如下所示:

ax[0].hist(qtime[jobs['charge_rate']==1], weights=area[jobs['charge_rate']==1],
           bins=bins, label='Normal', color='b')
ax[1].hist(qtime[jobs['charge_rate']==3], weights=area[jobs['charge_rate']==3],
           bins=bins, label='Express', color='g')

关于python - 使用 numpy 和 matplotlib 的总和直方图而不是计数，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/23671789/

24

4

0

文章推荐： c# - 找不到 WCF 服务引用命名空间

文章推荐： c# - 为什么 const mytype _var = new mytype() 不起作用？

文章推荐： c# - 通过 ignorecase 查找数组索引

文章推荐： c# - 为什么当我切换语义缩放时，它没有导航到该部分？

matplotlib - matplotlib 中对数极坐标图轴标签的定位
我无法在此图中定位轴标签。我喜欢放置顶部标签，使管道与网格对齐，并放置左右标签，以便它们不接触绘图。我试过了 ax.tick_params(axis='both', which='both'
matplotlib - matplotlib 中的条形图应该如何设置宽度？
我使用的是 python 2，下面的代码只是使用了一些示例数据，我的实际数据可能有不同的长度，并且可能不是很细。 import numpy as np import datetime i
matplotlib - Matplotlib 中的线段
给定坐标 [1,5,7,3,5,10,3,6,8]为 matplotlib.pyplot ，如何突出显示或着色线条的不同部分。例如，列表中的坐标 1-3 ( [1,5,7,3] ) 表示属性 a .我
matplotlib - Matplotlib 3D绘图中的较深背景
我正在matplotlib中绘制以下图像。我的问题是，图像看起来像这样，但是，我想使背景变暗，因为当我打印该图像时，灰度部分不会出现在打印物中。有人可以告诉我API进行此更改吗？我使用简单的API
matplotlib - matplotlib，逐步动画
这是关于matplotlib的一个非常基本的问题，但是我不知道该怎么做: 我想绘制多个图形，并使用绘制窗口中的箭头从一个移到另一个。目前，我只知道如何创建多个图并将其绘制在不同的窗口中，如下所示:
matplotlib - matplotlib 补丁绘图中的工件
在 matplotlib 中绘制小块对象时，由于显示分辨率而引入了伪影。使用抗锯齿并不能解决问题。这个问题有解决方案吗？ import matplotlib.pyplot as plt impo
matplotlib - matplotlib 中的未填充条形图
对于直方图，有一个简单的内置选项 histtype='step' .如何制作相同风格的条形图？最佳答案 [阅读评论后添加答案] 将可选关键字设置为 fill=False对于条形图: import m
matplotlib - matplotlib 子图中的图例位置
我正在尝试在 (6X3) 网格上创建子图。我对图例的位置有疑问。图例对所有子图都是通用的。 lgend 现在与 y 轴标签重叠我尝试删除 constrained_layout=True 选项。但这在
matplotlib - matplotlib 中的点和线工具提示？
我有一个带有一些线段( LineCollection )和一些点的图表。这些线和点有一些与它们相关的值，但没有绘制出来。我希望能够添加鼠标悬停工具提示或其他方法来轻松找到点和线的关联值。这对于点或线段
matplotlib - Matplotlib 图图例中的制表符对齐
我想创建一个带有对齐不同曲线文本的图例的图。这是一个最小的工作示例: import matplotlib.pyplot as plt import numpy as np x=np.linspace(
matplotlib - Matplotlib:图例中的水平线长
可以说我正在用matplotlib绘制一条线并添加一个图例。在图例中，其显示为------ Label。当绘制较小的图形尺寸以进行打印时，我发现该行的默认水平长度太长。是否存在将------ La
matplotlib - matplotlib 图形中的常见起源
我正在使用 matplotlib 构建一个 3D 散点图，但无法使生成的图形具有所有 3 个轴的共同原点。我怎样才能做到这一点？我的代码(到目前为止)，我还没有为轴规范实现任何定义，因为我对 Pyt
matplotlib - matplotlib 中是否存在用于在子图中定义子图网格的工具？
我有一个我想使用的绘图布局，其中 9 个不同的数据簇被布置在一个方形网格上。网格中的每个框都包含 3 个并排布置的箱线图。我最初的想法是这将适合 3x3 子图布局，每个单独的子图本身被划分为 3x1
matplotlib - Matplotlib，如何在数据坐标之外的图形外部编写注释？
我的图形从y=-1变为y=10 我想在任意位置写一小段文字，例如x=2000，y=5: ax.annotate('MgII', xy=(2000.0, 5.0), xycoords='data')
matplotlib - Matplotlib-在LateX表达式中使用变量
我想使用LateX格式来构建一个表达式，其中出现一些数字，但这些数字是用LateX表达式中的变量表示的。实际的目标是在axes.annotate()方法中使用它，但是为了讨论起见，这里是一个原理代码
matplotlib - Matplotlib 中的叠加轮廓图
我需要比较两组的二维分布。当我使用 matplotlib.pyplot.contourf并覆盖图，每个等高线图的背景颜色填充整个图空间。有没有办法让每个等高线图的最低等高线级别透明，以便更容易看到每
matplotlib - matplotlib —以交互方式选择点或位置？
在R中，有一个locator函数，类似于Matlab的ginput，您可以用鼠标单击图形并选择任何x，y坐标。此外，还有一个名为identify(x,y)的函数，如果您给它绘制了一组绘制的点x，y，然
matplotlib - matplotlib:生成矢量图
我想用matplotlib生成矢量图。我尽力了-但输出是光栅图像。这是我使用的： import matplotlib matplotlib.use('Agg') import matplotlib.p
matplotlib - matplotlib 中的小散点图标记始终为黑色
我正在尝试使用 matplotlib 制作具有非常小的灰点的散点图。由于点密度的原因，点需要很小。问题是 scatter() 函数的标记似乎既有线条又有填充。当标记很小时，只有线条可见，而看不到填充，
matplotlib - matplotlib 中的垂直线和水平线
我不太明白为什么我无法在指定的限制内创建水平和垂直线。我想用这个框绑定(bind)数据。然而，双方似乎并没有遵守我的指示。为什么是这样？ # CREATING A BOUNDING BOX # BOT

首页

博学

6Ren·AI

商城

python - 使用 numpy 和 matplotlib 的总和直方图而不是计数