- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个必须使用 pl/pgsql 进行一系列查询的过程:
--process:
SELECT function1();
SELECT function2();
SELECT function3();
SELECT function4();
为了能够在一次调用中执行所有操作,我创建了一个流程函数:
CREATE OR REPLACE FUNCTION process()
RETURNS text AS
$BODY$
BEGIN
PERFORM function1();
PERFORM function2();
PERFORM function3();
PERFORM function4();
RETURN 'process ended';
END;
$BODY$
LANGUAGE plpgsql
问题是,当我将每个函数本身花费的时间加起来时,总计为 200 秒,而函数 process()
花费的时间超过一个小时!
也许是内存问题,但我不知道应该更改 postgresql.conf
上的哪个配置。
数据库在 Debian 8 中的 PostgreSQL 9.4 上运行。
最佳答案
您评论说这 4 个函数必须连续 运行。因此,可以安全地假设每个函数都处理表中已被前一个函数修改的数据。这是我的主要嫌疑人。
任何 Postgres 函数都在外部上下文的事务中运行。因此,如果打包到另一个函数中,所有函数都共享相同的事务上下文。显然,每个人都可以看到以前功能对数据的影响。 (尽管效果对其他并发事务仍然不可见。)但统计数据不会立即更新。
查询计划基于 statistics在涉及的对象上。 PL/pgSQL 在实际执行之前不会计划语句,这对您有利。 Per documentation:
As each expression and SQL command is first executed in the function,the PL/pgSQL interpreter parses and analyzes the command to create aprepared statement, using the SPI manager's SPI_prepare function.
PL/pgSQL 可以缓存查询计划,但只能在同一 session 中并且(在 pg 9.2 中+ 至少)只有在几次执行表明相同的查询计划重复运行效果最好之后。如果您怀疑这对您来说是错误的,您可以使用动态 SQL 解决它,它每次都会强制执行一个新计划:
EXECUTE 'SELECT function1()';
但是,我看到的最有可能的候选对象是导致劣质查询计划的无效统计信息。 SELECT
/PERFORM
函数内的语句(相同的东西)快速连续运行,没有机会 autovacuum启动并更新一个函数与下一个函数之间的统计数据。如果一个函数大量改变了下一个函数正在处理的表中的数据,则下一个函数可能会根据过时的信息制定查询计划。典型示例:一个只有几行的表填满了数千行,但下一个计划仍然认为顺序扫描对于“小”表是最快的。你声明:
when I sum the time that each function takes by itself, the total is200 seconds, while the time that the function process() takes is morethan one hour!
“本身”是什么意思?究竟是什么意思?您是在单个事务中还是在单个事务中运行它们?也许中间有一段时间?这将允许 autovacuum 更新统计信息(通常相当快)并可能导致基于更改后的统计信息的完全不同的查询计划。
您可以使用 auto-explain 检查内部 plpgsql 函数的查询计划
如果您可以识别此类问题,则可以在语句之间强制使用 ANALYZE
。就此而言,对于几个 SELECT
/PERFORM
语句,您还不如使用更简单的 SQL 函数 并完全避免计划缓存(但是见下文!):
CREATE OR REPLACE FUNCTION process()
RETURNS text
LANGUAGE sql AS
$func$
SELECT function1();
ANALYZE some_substantially_affected_table;
SELECT function2();
SELECT function3();
ANALYZE some_other_table;
SELECT function4();
SELECT 'process ended'; -- only last result is returned
$func$;
此外,只要我们看不到您所调用函数的实际代码,就可能存在任意数量的其他隐藏效果。
示例:您可以SET LOCAL ...
一些配置参数来提高function1()
的性能。如果在单独的事务中调用,则不会影响其余部分。效果只持续到交易结束。但是,如果在单个事务中调用它,它也会影响其余部分......
基础知识:
另外:事务会累积锁,这会绑定(bind)越来越多的资源,并可能导致与并发进程的摩擦增加。所有锁都在事务结束时释放。最好在尽可能单独的事务 中运行大型函数,而不是将其封装在单个函数(以及事务)中。最后一项与什么有关 @klin和 IMSoP已经涵盖了。
关于postgresql - 在不损失性能的情况下同时执行多个功能,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/30351256/
我正在构建一个 RCP 应用程序,其中每个季度都会更新功能/插件。因此,如果用户选择自动更新功能/插件,则会下载更新插件的新 jar,但旧插件仍在使用我不再使用的磁盘空间。 我厌倦了删除包含旧 jar
我如何从外部 Controller 功能中调用 Controller 内部的功能,例如电话间隙回调功能 这是 Controller 外部定义的功能 function onDeviceReady()
如果某个功能(例如 MediaSource)可用,我如何使用 Google Dart 检查。 new MediaSource() 抛出一个错误。如何以编程方式检查此类或功能是否存在?有任何想法吗?是否
我正在尝试运行 Azure Orchestrations,突然我开始从 statusQueryGetUri 收到错误: 协调器函数“UploadDocumentOrchestrator”失败:函数“U
我见过 iPhone 上的应用程序,如果在 3.0 上运行,将使用 3.0 功能/API,例如应用内电子邮件编辑器,如果在 2.x 上运行,则不使用这些功能,并退出应用程序以启动邮件相反。 这是怎么做
这是 DB 规范化理论中的一个概念: Third normal form is violated when a non-key field is a fact about another non-ke
如果我定义 #if SOMETHING #endif 而且我还没有在任何地方定义 SOMETHING。 #if 中的代码会编译吗? 最佳答案 当#if的参数表达式中使用的名称未定义为宏时(在所有其他宏
我刚刚澄清了 A* 路径查找应该如何在两条路径具有相等值的 [情况] 下运行,无论是在计算期间还是在结束时,如果有两条相等的短路径。 例如,我在我的起始节点,我可以扩展到两个可能的节点,但它们都具有相
Java有没有类似下面的东西 宏 一种遍历所有私有(private)字段的方法 类似于 smalltalk symbols 的东西——即用于快速比较静态字符串的东西? 请注意,我正在尝试为 black
这个程序应该将华氏度转换为摄氏度: #include int main() { float fahrenheit, celsius; int max, min, step;
当打开PC缓存功能后, 软件将采用先进先出的原则排队对示波器采集的每一帧数据, 进行帧缓存。 当发现屏幕中有感兴趣的波形掠过时, 鼠标点击软件的(暂停)按钮, 可以选择回看某一帧的波形
我有一个特殊的(虚拟)函数,我想在沙盒环境中使用它: disable.system.call eval(parse(text = 'model.frame("1 ~ 1")'), envir = e
使用新的 Service 实现,我是否必须为我的所有服务提供一个 Options 方法? 使用我的所有服务当前使用的旧 ServiceBase 方法,OPTIONS 返回 OK,但没有 Access-
我正在阅读 Fogus 的关于 Clojure 的喜悦的书,在并行编程章节中,我看到了一个函数定义,它肯定想说明一些重要的事情,但我不知道是什么。此外,我看不到这个函数有什么用 - 当我执行时,它什么
我有大量的 C 代码,大部分代码被注释掉和/或 #if 0。当我使用 % 键匹配 if-else 的左括号和右括号时,它也匹配注释掉的代码。 有没有办法或vim插件在匹配括号时不考虑注释掉或#if 0
我有这个功能: map(map(fn x =>[x])) [[],[1],[2,3,4]]; 产生: val it = [[],[[1]],[[2],[3],[4]]] 我不明白这个功能是如何工作的。
我使用 Visual Studio 代码创建了一个函数应用程序,然后发布了它。功能应用程序运行良好。我现在在功能门户中使用代码部署功能(KUDU)并跳过构建。下面是日志 9:55:46 AM
我有一个数据框df: userID Score Task_Alpha Task_Beta Task_Charlie Task_Delta 3108 -8.00 Easy Easy
我真的无法解决这个问题: 我有一个返回数据框的函数。但是,数据框仅打印在我的控制台中,尽管我希望将其存储在工作空间中。我怎样才能做到这一点? 样本数据: n <- 32640 t <- seq(3*p
有没有办法找出所有可能的激活器命令行选项? activator -help仅提供最低限度的可用选项/功能列表,但所有好的东西都隐藏起来,即使在 typesafe 网站在线文档中也不可用。 到目前为止,
我是一名优秀的程序员,十分优秀!