- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个名为camera_activities
的表,里面有超过数百万条记录,表结构如下
CREATE TABLE camera_activities
(
id serial NOT NULL,
camera_id integer NOT NULL,
access_token_id integer,
action text NOT NULL,
done_at timestamp with time zone NOT NULL,
ip inet,
extra json,
camera_exid text,
name text
)
WITH (
OIDS=FALSE
);
ALTER TABLE camera_activities
OWNER TO 8hhjhjgghg7;
-- Index: camera_activities_camera_id_done_at_index
-- DROP INDEX camera_activities_camera_id_done_at_index;
CREATE UNIQUE INDEX camera_activities_camera_id_done_at_index
ON camera_activities
USING btree
(camera_id, done_at);
一条记录就像
问题来了
我想把2016年之前的记录全部删掉,那么多,范围是2014年等等,我们从2014年开始加数据..
我尝试了一个简单的查询并且效果很好,例如,如果我在 2 个日期之间删除 as
delete from camera_activities where done_at>'2017-07-12 10:55:37+00' and done_at<='2017-07-13 09:23:00+00
这行得通,但是很耗时,有超过数百万条记录,有什么快速的方法可以完成这项工作吗?
注意:如果我可以将日期范围增加到一个月或一个月以上,查询将继续运行并且不会返回任何结果。
任何帮助或指导都会有所帮助,
最佳答案
有两种基本方法可以执行大量 DELETE 操作。
1) 创建另一个表,删除旧表并重命名新表,最后ANALYZE
新表:
begin;
create table camera_activities_new (like camera_activities including all);
insert into camera_activities_new
select * from camera_activities
where done_at >= ''2016-01-01'::date;
alter sequence camera_activities_id_seq owned by camera_activities_new;
drop table camera_activities;
alter table camera_activities_new rename to camera_activities;
alter index camera_activities_new_camera_id_done_at_idx rename to camera_activities_camera_id_done_at_idx;
commit;
analyze camera_activities;
这种方法保证生成的表格将处于最佳状态(无膨胀)。但是如果你的系统负载很重并且涉及到表,它可能不太方便。在这种情况下,“平滑删除”可能看起来更好。
2) “平滑”删除:每次只删除相对少量的行,使用更积极的 autovacuum 设置并控制膨胀。
示例,显示如何将删除拆分为多个独立事务(在 bash 中;依赖于 $PGDATABASE
、$PGHOST
、$PGUSER
, $PGPASSWORD
环境变量):
while true; do
res=$(psql -c "delete from camera_activities where id in (select id camera_activities where done_at < '2016-01-01'::date limit 500);" \
| grep DELETE | awk {'print $2'} )
if [[ $res = '0' ]]; then break; fi;
sleep 0.3; # control speed here; check bloating level
done
– 当没有要删除的行时,这将自动停止。
您在(camera_id, done_at)
上的索引应该加速子选择,进行位图索引扫描——检查EXPLAIN
。但是在 done_at
上有一个单独的索引可能是值得的,在这种情况下它可以是 btree
或 brin
(有损但大小更小):
create i_camera_activities_done_at on camera_activities using brin(done_at);
“更积极的”(比默认的)autovacuum 设置示例:
log_autovacuum_min_duration = 0
autovacuum_vacuum_scale_factor = 0.01
autovacuum_analyze_scale_factor = 0.05
autovacuum_naptime = 60
autovacuum_vacuum_cost_delay = 20
有助于查看表格膨胀程度的不同查询:
关于sql - 从日期范围内的表中删除数百万条记录,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/45102469/
我有一个网站。 必须登录才能看到里面的内容。 但是,我使用此代码登录。 doc = Jsoup.connect("http://46.137.207.181/Account/Login.aspx")
我正在尝试为我的域创建一个 SPF 记录并使我的邮件服务器能够对其进行评估。我在邮件服务器上使用 Postfix 并使用 policyd-spf (Python) 来评估记录。目前,我通过我的私有(p
我需要为负载平衡的 AWS 站点 mywebsite.com 添加 CName 记录。记录应该是: @ CNAME mywebsite.us-east-1.elb.amazon
我目前正在开发一个相当大的多层应用程序,该应用程序将部署在海外。虽然我希望它在解聚后不会折叠或爆炸,但我不能 100% 确定这一点。因此,如果我知道我可以请求日志文件,以准确找出问题所在以及原因,那就
我使用以下命令从我的网络摄像头录制音频和视频 gst-launch-0.10 v4l2src ! video/x-raw-yuv,width=640,height=480,framerate=30/1
我刚刚开始使用 ffmpeg 将视频分割成图像。我想知道是否可以将控制台输出信息保存到日志文件中。我试过“-v 10”参数,也试过“-loglevel”参数。我在另一个 SO 帖子上看到使用 ffmp
我想针对两个日期查询我的表并检索其中的记录。 我这样声明我的变量; DECLARE @StartDate datetime; DECLARE @EndDate datetime; 并像这样设置我的变量
在 javascript 中,我可以使用简单的 for 循环访问对象的每个属性,如下所示 var myObj = {x:1, y:2}; var i, sum=0; for(i in myObj) s
最近加入了一个需要处理大量代码的项目,我想开始记录和可视化调用图的一些流程,让我更好地理解一切是如何组合在一起的。这是我希望在我的理想工具中看到的: 每个节点都是一个函数/方法 如果一个函数可以调用另
如何使用反射在F#中创建记录类型?谢谢 最佳答案 您可以使用 FSharpValue.MakeRecord [MSDN]创建一个记录实例,但是我认为F#中没有任何定义记录类型的东西。但是,记录会编译为
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。 想改善这个问题吗?更新问题,使其成为 on-topic对于堆栈溢出。 3年前关闭。 Improve thi
我是 Sequelize 的新手并且遇到了一些语法问题。我制作了以下模型: // User sequelize.define('user', { name: { type: DataTyp
${student.name} Notify 这是我的output.jsp。请注意,我已经放置了一个链接“Notify”以将其转发到 display.jsp 上。但我不确定如何将 Stud
例如,这是我要做的查询: server:"xxx.xxx.com" AND request_url:"/xxx/xxx/xxx" AND http_X_Forwarded_Proto:(https O
我一直在开发大量 Java、PHP 和 Python。所有这些都提供了很棒的日志记录包(分别是 Log4J、Log 或logging)。这在调试应用程序时有很大帮助。特别是当应用程序 headless
在我的Grails应用程序中,我异步运行一些批处理过程,并希望该过程记录各种状态消息,以便管理员以后可以检查它们。 我考虑过将log4j JDBC附加程序用作最简单的解决方案,但是据我所知,它不使用D
我想将进入 MQ 队列的消息记录到数据库/文件或其他日志队列,并且我无法修改现有代码。是否有任何方法可以实现某种类似于 HTTP 嗅探器的消息记录实用程序?或者也许 MQ 有一些内置的功能来记录消息?
如果我有一条包含通用字段的记录,在更改通用字段时是否有任何方法可以模仿方便的 with 语法? 即如果我有 type User = // 'photo can be Bitmap or Url {
假设我有一个名为 Car 的自定义对象。其中的所有字段都是私有(private)的。 public class Car { private String mName; private
当记录具有特定字段时,我需要返回 true 的函数,反之亦然。示例: -record(robot, {name, type=industrial, ho
我是一名优秀的程序员,十分优秀!