python - Pandas 如何按时间段过滤 DataFrame-6ren

python - Pandas 如何按时间段过滤 DataFrame

转载作者：行者123 更新时间：2023-11-28 20:34:11

30

4

我有一个包含下表的文件:

    Name        AvailableDate            totalRemaining
0   X3321       2018-03-14 13:00:00      200
1   X3321       2018-03-14 14:00:00      200
2   X3321       2018-03-14 15:00:00      200
3   X3321       2018-03-14 16:00:00      200
4   X3321       2018-03-14 17:00:00      193

我想返回一个包含特定时间期间所有记录的DataFrame，而不考虑实际的日期。

我按照这里的例子:

filter pandas dataframe by time

但是当我执行以下命令时:

## setup
import pandas as pd
import numpy as np

### Step 2
### Check available slots
file2 = r'C:\Users\user\Desktop\Files\data.xlsx'

slots = pd.read_excel(file2,na_values='')

## filter the preferred ones
slots['nextAvailableDate'] = pd.to_datetime((slots['nextAvailableDate']))


slots['times'] = pd.to_datetime((slots['nextAvailableDate']))
slots = slots[slots['times'].between('21:00:00', '02:00:00')]

这将返回空 DataFrame 以及此解决方案:

slots = slots[slots['times'].dt.strftime('%H:%M:%S').between('21:00:00', '02:00:00')]

有没有一种方法可以在不单独为时间创建列的情况下正确地做到这一点？请问我该如何解决这个问题？

我的目标:

Name        AvailableDate            totalRemaining
0   X3321       2018-03-14 21:00:00      200
1   X3321       2018-03-14 22:00:00      200
2   X3321       2018-03-14 23:00:00      200
3   X3321       2018-03-14 00:00:00      200
4   X3321       2018-03-14 01:00:00      193

对于出现在数据集中的每一天。

最佳答案

我认为需要between_time使用由 set_index 创建的 Datetimeindex , 对于列添加 reset_index与 reindex对于相同的列顺序:

print (slots)
     Name        AvailableDate  totalRemaining
0   X3321  2018-03-14 21:00:00             200
1   X3321  2018-03-14 20:00:00             200
2   X3321  2018-03-14 22:00:00             200
3   X3321  2018-03-14 23:00:00             200
4   X3321  2018-03-14 00:00:00             200
5   X3321  2018-03-14 01:00:00             193
6   X3321  2018-03-14 13:00:00             200
7   X3321  2018-03-14 14:00:00             200
8   X3321  2018-03-14 15:00:00             200
9   X3321  2018-03-14 16:00:00             200
10  X3321  2018-03-14 17:00:00             193

slots['AvailableDate'] = pd.to_datetime(slots['AvailableDate'])

df = (slots.set_index('AvailableDate')
          .between_time('21:00:00', '02:00:00')
          .reset_index()
          .reindex(columns=df.columns))
print (df)
        AvailableDate   Name  totalRemaining
0 2018-03-14 21:00:00  X3321             200
1 2018-03-14 22:00:00  X3321             200
2 2018-03-14 23:00:00  X3321             200
3 2018-03-14 00:00:00  X3321             200
4 2018-03-14 01:00:00  X3321             193

关于python - Pandas 如何按时间段过滤 DataFrame，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/49172824/

30

4

0

文章推荐： javascript - jquery 事件委托(delegate)背后是什么？

文章推荐： Python:制作包含两列项目的字典

文章推荐： python - 如何一次操纵一行？

文章推荐： javascript - 插入的 DOM 节点的类未被传递

Java 时间段(十进制年数)
如果我使用以下方法计算 java.time 中 2 个 LocalDate 之间的差异: Period p = Period.between(testDate, today); 然后我得到一个包含年、
sql - 表示日期/时间段
我正在开发一个有多种不同费率的预订平台。这些费率由一天中的时间、星期几和一年中的一天决定。以下是所涉及的间隔类型的一些示例: 周一至周五，上午 9 点至下午 5 点周六和周日，中午 12 点到早上
r - 时间段 R 的条件总和
我有大量数据，包括开始时间、停止时间和值。开始和停止时间因行而异，以 5 分钟为增量。我正在尝试创建一个新的数据框，该数据框具有 5 分钟的间隔以及该间隔在行的开始和停止范围内的所有行的总和。我有一
mysql - 时间段 SQL 查询
我有一个这样的表: --------------------------------------------- |Id | Step | StartedAt
两个日期之间的 C# 时间段(以周为单位)
我有一个网络应用程序，用户将在其中输入 2 个日期。一个 StartDate 和一个 EndDate。现在我想编写它，以便在选择 StartDate 和 EndDate 时确定有多少周，然后显示这些周
java - 如何比较两个 Joda 时间段
这看起来并不直截了当。我正在尝试: @Override public int compare(Period o1, Period o2) { return o1.toStandardDays
php - iCal 不显示组织者的 session 时间段
我必须为团队发送 session 邀请，这是我的邮件 $ical = 'BEGIN:VCALENDAR PRODID:-//Microsoft Corporation//Outlook 11.0
php - DateInterval 不接受以毫秒为单位的 ISO 8601 时间段
我有这个 ISO 8601 时间段字符串: P0Y0M0DT3H5M0.000S 并且 PHP7.4 无法用它构造 DateInterval。 format('%h Hours %m Minutes
time - LibreOffice SUM 时间段，格式为 HH :MM:SS
我想要获取包含一段时间(格式为 HH:MM:SS)的多个单元格的总和。在 LibreOffice Calc 4.0.3.3 中，我复制粘贴了 G14:G21 范围内的时间段，并将单元格格式设置为时间
mysql - SELECT/GROUP BY - 时间段(10 秒、30 秒等)
我有一个表(MySQL)，每n秒捕获一次样本。该表有很多列，但重要的是两列:时间戳(TIMESTAMP 类型)和计数(INT 类型)。我想做的是获取一定时间范围内计数列的总和和平均值。例如，我每 2
mysql - SELECT/GROUP BY - 时间段(10 秒、30 秒等)
我有一个表(MySQL)，每n秒捕获一次样本。该表有很多列，但重要的是两列:时间戳(TIMESTAMP 类型)和计数(INT 类型)。我想做的是获取一定时间范围内计数列的总和和平均值。例如，我每 2
java - 使用 Joda-Time PeriodFormatter 显示 "negative"时间段
我在一个项目上使用 joda-time (1.6.2)，我正在做的其中一件事就是计算预测时间和实际时间之间的差异。这种差异有时是积极的，有时是消极的。虽然适当的方法可能是使用 Duration 而不是
mysql - SELECT/GROUP BY - 时间段(10 秒、30 秒等)
我有一个表 (MySQL)，它每 n 秒捕获一次样本。该表有很多列，但最重要的是两列:一个时间戳(TIMESTAMP 类型)和一个计数(INT 类型)。我想做的是获取计数列在一段时间内的总和和平均值
date-range - 如何在 Google Data Studio 中创建 'past 3 months' 时间段
我想让我的折线图显示过去 3 个月的数据。 GDS 有一个“最后一个季度”的日期范围，但这显示的是 Q1、Q2、Q3 或 Q4。我需要的是过去3个整月(不算当月)的数据。我尝试创建一个计算字段，但事实
date-range - 如何在 Google Data Studio 中创建 'past 3 months' 时间段
我想让我的折线图显示过去 3 个月的数据。 GDS 有一个“最后一个季度”的日期范围，但这显示的是 Q1、Q2、Q3 或 Q4。我需要的是过去3个整月(不算当月)的数据。我尝试创建一个计算字段，但事实

首页

博学

6Ren·AI

商城

python - Pandas 如何按时间段过滤 DataFrame