- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
有没有办法将 CSV 文件数据直接复制到 JSON 或 JSONb 数组中?
例子:
CREATE TABLE mytable (
id serial PRIMARY KEY,
info jSONb -- or JSON
);
COPY mytable(info) FROM '/tmp/myfile.csv' HEADER csv;
注意:每个 CSV 行都映射到一个 JSON 数组。这是一个普通的 CSV。
普通 CSV(未嵌入 JSON)... /tmp/myfile.csv
=
a,b,c
100,Mum,Dad
200,Hello,Bye
正确的 COPY 命令必须等同于通常的复制波纹管。
CREATE TEMPORARY TABLE temp1 (
a int, b text, c text
);
COPY temp1(a,b,c) FROM '/tmp/myfile.csv' HEADER csv;
INSERT INTO mytable(info) SELECT json_build_array(a,b,c) FROM temp1;
它很丑因为:
需要关于字段的先验知识,以及之前的CREATE TABLE
。
“大数据”需要一个大的临时表,这样就浪费了 CPU、磁盘和我的时间 — 表 mytable
的每一行都有 CHECKs 和 UNIQUEs 约束。
...需要多于 1 个 SQL 命令。
最佳答案
不需要知道所有 CSV 列,只提取您知道的内容。
在 SQL CREATE EXTENSION PLpythonU;
中使用:如果命令产生类似“无法打开扩展控制文件......没有这样的文件”的错误,你需要安装pg-py 额外包。在标准 UBUNTU (16 LTS) 中很简单,apt install postgresql-contrib postgresql-plpython
。
CREATE FUNCTION get_csvfile(
file text,
delim_char char(1) = ',',
quote_char char(1) = '"')
returns setof text[] stable language plpythonu as $$
import csv
return csv.reader(
open(file, 'rb'),
quotechar=quote_char,
delimiter=delim_char,
skipinitialspace=True,
escapechar='\\'
)
$$;
INSERT INTO mytable(info)
SELECT jsonb_build_array(c[1],c[2],c[3])
FROM get_csvfile('/tmp/myfile1.csv') c;
split_csv() 函数是 defined here . csv.reader
非常可靠 (!)。
未针对 big-big CSV 进行测试...但预期 Python 可以完成工作。
这不是一个完美的解决方案,但它解决了主要问题,即
... big temporary table, so lost CPU, disk and my time"...
这就是我们的方法,使用 file_fdw
的解决方法!
采用您的约定以避免文件复制和文件权限混淆... CSV 的标准文件路径。示例:/tmp/pg_myPrj_file.csv
使用魔术扩展初始化您的数据库或 SQL 脚本,
CREATE EXTENSION file_fdw;
CREATE SERVER files FOREIGN DATA WRAPPER file_fdw;
对于每个 CSV 文件,myNewData.csv
,
3.1。为您的新文件创建符号链接(symbolic link)(或 scp
远程副本)ln -sf $PWD/myNewData.csv/tmp/pg_socKer_file.csv
3.2。为您的新表配置 file_fdw(假设 mytable
)。
CREATE FOREIGN TABLE temp1 (a int, b text, c text)
SERVER files OPTIONS (
filename '/tmp/pg_socKer_file.csv',
format 'csv',
header 'true'
);
PS:在使用psql
运行SQL 脚本后,当遇到一些权限问题时,通过sudo chown -h postgres:postgres/tmp/pg_socKer_file.csv
更改链接的所有者>。
3.3。使用 file_fdw 表作为源(假设填充 mytable
)。
INSERT INTO mytable(info)
SELECT json_build_array(a,b,c) FROM temp1;
感谢@JosMac(和 his tutorial)!
注意:如果有 STDIN 方法(存在??),会很容易,避免权限问题和使用绝对路径。参见 this answer/discussion .
关于postgresql - 如何将 CSV 复制为 JSON 字段,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/41465793/
最近开始学习MongoDB。今天老师教了我们 mongoexport 命令。在练习时,我遇到了一个典型的问题,包括教练在内的其他同学都没有遇到过。我在我的 Windows 10 机器上使用 Mongo
我是 JSON Schema 的新手,读过什么是 JSON Schema 等等。但我不知道如何将 JSON Schema 链接到 JSON 以针对该 JSON Schema 进行验证。谁能解释一下?
在 xml 中,我可以在另一个 xml 文件中包含一个文件并使用它。如果您的软件从 xml 获取配置文件但没有任何方法来分离配置,如 apache/ngnix(nginx.conf - site-av
我有一个 JSON 对象,其中包含一个本身是 JSON 对象的字符串。我如何反序列化它? 我希望能够做类似的事情: #[derive(Deserialize)] struct B { c: S
考虑以下 JSON { "a": "{\"b\": 12, \"c\": \"test\"}" } 我想定义一个泛型读取 Reads[Outer[T]]对于这种序列化的 Json import
关闭。这个问题不满足Stack Overflow guidelines .它目前不接受答案。 想改善这个问题吗?更新问题,使其成为 on-topic对于堆栈溢出。 11 个月前关闭。 Improve
我的旧项目在 MySQL 中有 Standard JSON 格式的数据。 对于我在 JS (Node.js) 和 DynamoDB 中的全新项目,关于 Standard JSON格式: 是否建议将其转
JSON 值字符串、数字、true、false、null 是否是有效的 JSON? 即,是 true 一个有效的 JSON 文档?还是必须是数组/对象? 一些验证器接受这个(例如 http://jso
我有一个 JSON 字符串,其中一个字段是文本字段。这个文本字段可以包含用户在 UI 中输入的文本,如果他们输入的文本是 JSON 文本,也许是为了说明一些编码,我需要对他们的文本进行编码,以便它不会
我正在通过 IBM MQ 调用处理数据,当由 ColdFusion 10 (10,0,11,285437) 序列化时,0 将作为 +0.0 返回,它会导致无效的 JSON并且无法反序列化。 stPol
我正在从三个数组中生成一个散列,然后尝试构建一个 json。我通过 json object has array 成功了。 require 'json' A = [['A1', 'A2', 'A3'],
我从 API 接收 JSON,响应可以是 30 种类型之一。每种类型都有一组唯一的字段,但所有响应都有一个字段 type 说明它是哪种类型。 我的方法是使用serde .我为每种响应类型创建一个结构并
我正在下载一个 JSON 文件,我已将其检查为带有“https://jsonlint.com”的有效 JSON 到文档目录。然后我打开文件并再次检查,结果显示为无效的 JSON。这怎么可能????这是
我正在尝试根据从 API 接收到的数据动态创建一个 JSON 对象。 收到的示例数据:将数据解码到下面给出的 CiItems 结构中 { "class_name": "test", "
我想从字符串转换为对象。 来自 {"key1": "{\n \"key2\": \"value2\",\n \"key3\": {\n \"key4\": \"value4\"\n }\n
目前我正在使用以下代码将嵌套的 json 转换为扁平化的 json: import ( "fmt" "github.com/nytlabs/gojsonexplode" ) func
我有一个使用来自第三方 API 的数据的应用程序。我需要将 json 解码为一个结构,这需要该结构具有“传入”json 字段的 json 标签。传出的 json 字段具有不同的命名约定,因此我需要不同
我想使用 JSON 架构来验证某些值。我有两个对象,称它们为 trackedItems 和 trackedItemGroups。 trackedItemGroups 是组名称和 trackedItem
考虑以下案例类模式, case class Y (a: String, b: String) case class X (dummy: String, b: Y) 字段b是可选的,我的一些数据集没有字
我正在存储 cat ~/path/to/file/blah | 的输出jq tojson 在一个变量中,稍后在带有 JSON 内容的 curl POST 中使用。它运作良好,但它删除了所有换行符。我知
我是一名优秀的程序员,十分优秀!