- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我需要将大量数据(几百万行)从一个表传输到另一个表。到目前为止,我已经尝试过这样做......
INSERT INTO TABLE_A (field1, field2)
SELECT field1, field2 FROM TABLE_A_20180807_BCK;
这(最终)对包含大约 1000 万行的表有效(耗时 24 小时)。问题是我还有其他几个表需要应用相同的过程,而且它们都大得多(最大的是 2000 万行)。我曾尝试对包含 1200 万行的表进行类似的加载,但未能在 48 小时内完成,因此我不得不取消它。
其他可能影响性能的问题是 1) TABLE_A 有一个基于自动生成序列的字段,2) TABLE_A 有一个 AFTER INSERT 触发器,它解析每个新记录并将第二条记录添加到 TABLE_B
许多其他线程建议执行 TABLE_A_20180807_BCK 的 pg_dump,然后将数据加载回 TABLE_A。我不确定 pg_dump 是否真的适合我,因为我只对 TABLE_A 中的几个字段感兴趣,而不是全部。
相反,我想知道以下......
导出为 CSV 文件......
COPY TABLE_A_20180807_BCK (field1,field2) to 'd:\tmp\dump\table_a.dump' DELIMITER ',' CSV;
导入回所需的表......
COPY TABLE_A(field1,field2) FROM 'd:\tmp\dump\table_a.dump' DELIMITER ',' CSV
导出/导入方法可能会更快吗?在我开始另一项可能需要数天才能完成的工作之前,我希望得到一些这方面的指导,甚至可能不会做得更好! “试一试看看”这个显而易见的答案并不是真正的选择,我无法承受更多的停机时间!
(这是来自 this 的后续问题,如果需要任何背景详细信息)
更新....我认为触发器没有任何重大问题。在正常情况下,记录以大约 1000/秒(包括触发时间)的速率输入到 TABLE_A 中。我认为问题很可能是事务的大小,在正常情况下,记录被插入到每个 INSERT 100 条记录的 block 中,上面显示的语句试图在单个事务中添加 1000 万条记录,我的猜测是这是问题,但我无法知道它是否真的存在,或者是否有合适的解决方法(或者我提出的导出/导入方法是否会更快)
也许我应该早点强调这一点,每次插入 TABLE_A 都会触发一个触发器,将记录添加到 TABLE_B。 TABLE_B 中的数据是最终目标,因此禁用触发器不是一个选项!整个问题的出现是因为我不小心将触发器禁用了几天,而“如何在现有行上运行触发器”这个问题的首选解决方案似乎是“删除行并再次将它们添加回来”——请参阅原文发布(上面的链接)以获取详细信息。
我目前的尝试涉及使用带有 WHERE 子句的 COPY 命令将 TABLE_A_20180807_BCK 的内容拆分为十几个小文件,然后一次重新加载一个。这可能不会给我节省任何整体时间,但虽然我无法承受 24 小时的连续停机时间,但我可以承受 4 晚 6 小时的停机时间。
最佳答案
准备(如果您有权访问并且可以重新启动您的服务器)将 checkpoint_segments 设置为 32 或更多。这将减少此操作期间检查点的频率和数量。您可以在完成后撤消它。此步骤并非完全必要,但应该会大大加快写入速度。
编辑 postgresql.conf 并将 checkpoint_segments 设置为 32 或更多
第 1 步:删除/删除表 A 上的所有索引和触发器。
编辑:步骤 1a
alter table_a set unlogged;
(对要插入的每个表重复第 1 步)
第 2 步。(如果一次只做一张 table 则不需要)
begin transaction;
第 3 步。
INSERT INTO TABLE_A (field1, field2)
SELECT field1, field2 FROM TABLE_A_20180807_BCK;
(对所有插入的表重复步骤 3)
第 4 步。(如果您一次只做一张 table 则不需要)
commit;
第 5 步在所有表上重新启用索引和触发器。
步骤 5a。
Alter table_a set logged;
关于postgresql - Postgres - 将数据从一个表批量传输到另一个表,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/52266266/
我有一台 MySQL 服务器和一台 PostgreSQL 服务器。 需要从多个表中复制或重新插入一组数据 MySQL 流式传输/同步到 PostgreSQL 表。 这种复制可以基于时间(Sync)或事
如果两个表的 id 彼此相等,我尝试从一个表中获取数据。这是我使用的代码: SELECT id_to , email_to , name_to , status_to
我有一个 Excel 工作表。顶行对应于列名称,而连续的行每行代表一个条目。 如何将此 Excel 工作表转换为 SQL 表? 我使用的是 SQL Server 2005。 最佳答案 这取决于您使用哪
我想合并两个 Django 模型并创建一个模型。让我们假设我有第一个表表 A,其中包含一些列和数据。 Table A -------------- col1 col2 col3 col
我有两个表:table1,table2,如下所示 table1: id name 1 tamil 2 english 3 maths 4 science table2: p
关闭。此题需要details or clarity 。目前不接受答案。 想要改进这个问题吗?通过 editing this post 添加详细信息并澄清问题. 已关闭 1 年前。 Improve th
下面两个语句有什么区别? newTable = orginalTable 或 newTable.data(originalTable) 我怀疑 .data() 方法具有性能优势,因为它在标准 AX 中
我有一个表,我没有在其中显式定义主键,它并不是真正需要的功能......但是一位同事建议我添加一个列作为唯一主键以随着数据库的增长提高性能...... 谁能解释一下这是如何提高性能的? 没有使用索引(
如何将表“产品”中的产品记录与其不同表“图像”中的图像相关联? 我正在对产品 ID 使用自动增量。 我觉得不可能进行关联,因为产品 ID 是自动递增的,因此在插入期间不可用! 如何插入新产品,获取产品
我有一个 sql 表,其中包含关键字和出现次数,如下所示(尽管出现次数并不重要): ____________ dog | 3 | ____________ rat | 7 | ____
是否可以使用目标表中的LAST_INSERT_ID更新源表? INSERT INTO `target` SELECT `a`, `b` FROM `source` 目标表有一个自动增量键id,我想将其
我正在重建一个搜索查询,因为它在“我看到的”中变得多余,我想知道什么 (albums_artists, artists) ( ) does in join? is it for boosting pe
以下是我使用 mysqldump 备份数据库的开关: /usr/bin/mysqldump -u **** --password=**** --single-transaction --databas
我试图获取 MySQL 表中的所有行并将它们放入 HTML 表中: Exam ID Status Assigned Examiner
如何查询名为 photos 的表中的所有记录,并知道当前用户使用单个查询将哪些结果照片添加为书签? 这是我的表格: -- -- Table structure for table `photos` -
我的网站都在 InnoDB 表上运行,目前为止运行良好。现在我想知道在我的网站上实时发生了什么,所以我将每个页面浏览量(页面、引荐来源网址、IP、主机名等)存储在 InnoDB 表中。每秒大约有 10
我在想我会为 mysql 准备两个表。一个用于存储登录信息,另一个用于存储送货地址。这是传统方式还是所有内容都存储在一张表中? 对于两个表...有没有办法自动将表 A 的列复制到表 B,以便我可以引用
我不是程序员,我从这个表格中阅读了很多关于如何解决我的问题的内容,但我的搜索效果不好 我有两张 table 表 1:成员 id*| name | surname -------------------
我知道如何在 ASP.NET 中显示真实表,例如 public ActionResult Index() { var s = db.StaffInfoDBSet.ToList(); r
我正在尝试运行以下查询: "insert into visits set source = 'http://google.com' and country = 'en' and ref = '1234
我是一名优秀的程序员,十分优秀!