hadoop - 使用 Hive QL 按时间间隔对时间序列进行采样并计算跳跃-6ren

hadoop - 使用 Hive QL 按时间间隔对时间序列进行采样并计算跳跃

转载作者：可可西里更新时间：2023-11-01 14:38:35

26

4

我的表中有时间序列数据。基本上每一行都有一个时间戳和一个值。数据的频率是绝对随机的。

我想以给定的频率对其进行采样，并为每个频率提取有关它的相关信息:最小值、最大值、最后值、变化(相对于先前)、返回(变化/先前)以及更多(计数... )

所以这是我的输入:

08:00:10, 1
08:01:20, 2
08:01:21, 3
08:01:24, 5
08:02:24, 2

我想获得 1 分钟采样的以下结果(ts、min、max、last、change、return):

ts        m  M  L  Chg   Return   
08:01:00, 1, 1, 1, NULL, NULL
08:02:00, 2, 5, 5, 4,    4
08:03:00, 2, 2, 2, -3,   -0.25

最佳答案

你可以用这样的东西来做(内联评论):

SELECT
    min
  , mn
  , mx
  , l
  , l - LAG(l, 1) OVER (ORDER BY min) c
    -- This might not be the right calculation. Unsure how -0.25 was derived in question.
  , (l - LAG(l, 1) OVER (ORDER BY min)) / (LAG(l, 1) OVER (ORDER BY min)) r
FROM
(
  SELECT
      min
    , MIN(val) mn
    , MAX(val) mx
    -- We can take MAX here because all l's (last values) for the minute are the same.
    , MAX(l) l
  FROM
  (
    SELECT
        min
      , val
      -- The last value of the minute, ordered by the timestamp, using all rows.
      , LAST_VALUE(val) OVER (PARTITION BY min ORDER BY ts ROWS BETWEEN UNBOUNDED PRECEDING AND UNBOUNDED FOLLOWING) l
    FROM
    (
      SELECT
          ts
        -- Drop the seconds and go back one minute by converting to seconds,
        -- subtracting 60, and then going back to a shorter string format.
        -- 2000-01-01 is a dummy date just to enable the conversion.
        , CONCAT(FROM_UNIXTIME(UNIX_TIMESTAMP(CONCAT("2000-01-01 ", ts), "yyyy-MM-dd HH:mm:ss") + 60, "HH:mm"), ":00") min       
        , val
      FROM
        -- As from the question.
        21908430_input a
    ) val_by_min
  ) val_by_min_with_l
  GROUP BY min
) min_with_l_m_M
ORDER BY min
;

结果:

+----------+----+----+---+------+------+
| min      | mn | mx | l | c    | r    |
+----------+----+----+---+------+------+
| 08:01:00 | 1  | 1  | 1 | NULL | NULL |
| 08:02:00 | 2  | 5  | 5 | 4    | 4    |
| 08:03:00 | 2  | 2  | 2 | -3   | -0.6 |
+----------+----+----+---+------+------+

关于hadoop - 使用 Hive QL 按时间间隔对时间序列进行采样并计算跳跃，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/21908430/

26

4

0

文章推荐： hadoop - 将大量 reducer 输出写入 HBase

文章推荐： windows - REG 添加一个 REG_MULTI_SZ 多行注册表值

文章推荐： c# - 让windows决定如何打开/运行文件？

文章推荐： Hadoop:在hadoop 2.0.0中编写Map reduce程序的主要区别是什么

日期中的 SQL 间隔
我试图根据表格看起来像这样的状态代码来查找表格中的空白。状态表: StateID (PK) | Code -------------------- 1 | AK 2
python - 如何按相反顺序找到两个字母之间的长度/间隔？
我有一个配对字符串列表。我想找到两个字母之间的长度/间隔。到目前为止，我可以使用找到有序字母的间隔 alpha =["AM", "KQ", "ZN", "XM", "UK"] leng
python - 如何按相反顺序找到两个字母之间的长度/间隔？
我有一个配对字符串列表。我想找到两个字母之间的长度/间隔。到目前为止，我可以使用找到有序字母的间隔 alpha =["AM", "KQ", "ZN", "XM", "UK"] leng
jquery TimePicker 间隔
我正在努力弄清楚如何将时间选择器的下拉间隔设置为 15 分钟间隔。默认为 30 分钟 atm。让它工作的正确调用/符号是什么？我已经尝试了很多将它们放入 '' 的变体，但没有任何进展。谢谢! $
MySQL加入 "connected"间隔
假设我有 table teach_subject(teacher_id, subject_id, min_grade_of_school, max_grade_of_school, color_in_
Javascript 一张一张显示图片，间隔
我有下面的图像，我试图以 3 秒的间隔一张一张地显示它们，但我无法让它工作。它继续停留在 0 并且不显示图像，帮助会很好: JavaScript: window.animate = functio
algorithm - 在最少数量的槽中安排作业/间隔
我认为这个问题类似于加权间隔调度问题，但略有不同。假设您有一个具有开始时间和结束时间的类次 s，该类次从 s.start 开始有 n 个空位到s.end。时隙是从 s.start 到 s.end 的
ios - 我怎样才能插入两个观点？间隔()不起作用
我试图将一个 GeometryReader 作为按钮推到屏幕底部，但 Spacer 在这里不起作用...... 这个想法是让应用程序响应所有屏幕尺寸。 VStack { GeometryRea
r - 2个逻辑向量的元素之间的快速最小距离(间隔)(取2)
我问了一个相关问题 here但意识到我在计算这个复杂的度量时花费了太多时间(目标是与随机化测试一起使用，所以速度是一个问题)。所以我决定放弃权重，只使用两个度量之间的最小距离。所以这里我有 2 个向量
docker-compose 健康检查重试频率 != 间隔
我最近成立 healthcheck s 在我的 docker-compose配置。它做得很好，我喜欢它。下面是一个典型的例子: services: app: healthcheck:
cocoa - 更改重复计时器的 NSTimer 间隔
我正在 Cocoa 中使用如下设置的 NSTimer 运行 mainLoop: mainLoopTimer = [NSTimer scheduledTimerWithTimeInter
android - 间隔 flutter 后命中api的更好方法
目前正在开发家庭自动化应用程序，其中有事件 API 可以在事件被触发时为我提供事件。但我想持续运行 API，以便跟踪在整个应用程序中触发的事件。还有一个主页，我在其中显示曾经发生的事件。它是一个简单的
elasticsearch - 日期范围查询中的 Elasticsearch 间隔
我有一个查询应该是这样的要求: { "size": 0, "_source": [ "dateCreated" ], "query": { "bool": {
php - 间隔 30 分钟的循环时间字符串
我有一个 UNIX 格式的时间字符串。我需要将该字符串四舍五入到最接近的 30 分钟间隔。例如:我的时间是上午 9:20，而不是应该四舍五入到上午 9:30。如果分钟数大于 30，例如上午 9:4
java - 运算符(operator)间隔
我有网络调用，我想定期调用它。我只想将运算符 Interval 与 flatMap 一起使用，但在间隔线程上。你能解释一下这种情况吗？我知道Interval只使用一个线程，任务是按顺序处理的。我有
ios - 减慢 CADisplayLink 间隔
我在我的 iOS 应用程序中使用了 NSTimer，但由于 SetNeedsDisplay，我没有得到我想要的结果。我做了一些研究并找到了 CADisplayLink，它为我提供了我想要的动画结果。
Java - 根据最小值、最大值和计数生成间隔/间隔
我需要通过给出值数组来生成 map 上图例的值。Java 库中是否有函数可以从值数组和计数值生成范围或区间？像这样的东西: Integer[] getIntervals(Number[] values
java - 在Java中以一定的时间间隔提供 sleep 间隔
我的函数中有以下代码，我试图从数据库中获取参数MAX_FAILED_ATTEMPT，并且基于此，如果检查失败，我将发送警报。当前代码将尝试从 MAX_FIELD_ATTEMPT 获取值并立即依次进行检
c# - Trackbar 上的特定值/间隔
我在这里要做的是像 Windows XP 上的那样放下一个轨迹栏来更改分辨率:( http://puu.sh/7Li5h.png ) 我想设置特定的间隔/增量值，如上图所示。目前，实际栏下方的线条已经
javascript - 停止 JavaScript 间隔
是否可以停止当前作为 setInterval 运行的函数？这是我的代码: 这是我调用的函数 function pull_light_status (lights_array) { $.get

首页

博学

6Ren·AI

商城

hadoop - 使用 Hive QL 按时间间隔对时间序列进行采样并计算跳跃