- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个(语法有效,但不是很大)CSV 文件。我想对其运行任意 SQL SELECT 查询;让我们假设 in 可以是一个复杂的查询,带有一些内部查询,带有自连接,可能带有窗口函数等。
现在,显然,我可以安装一个 DBMS,运行服务器进程,创建一个新的数据库,也许创建一个适当的表,将 CSV 数据加载到表中,然后最后使用数据库的客户端来发送查询并得到结果。
但是 - 这似乎很麻烦,而且我不需要再次加载数据库表来进行另一个查询。
那么,有没有一种更简单的方法可以通过命令行/shell session 来做到这一点,希望没有那么多开销和空间浪费?
注释:
最佳答案
如果您的操作系统中安装了 Java(这很常见),并且通过组合 Ant(脚本)和 H2(内存数据库),您可以从 CSV 文件中的数据运行复杂的 SQL 查询。
例如,如果您有文件 my_file.csv
如:
"name", "sex", "age", "height", "weight"
"Alex", "M", 41, 74, 170
"Bert", "M", 42, 66, 166
"Dave", "M", 39, 72, 167
"Elly", "F", 30, 70, 124
"Luke", "M", 34, 72, 163
"Omar", "M", 38, 69, 145
"Page", "F", 31, 67, 135
"Ruth", "F", 28, 65, 131
然后您可以创建script1.xml
Ant 脚本:
<project default="sql">
<target name="sql">
<sql driver="org.h2.Driver" url="jdbc:h2:mem:" userid="sa" password=""
classpath="./h2-2.1.214.jar" onerror="abort" print="true"
showheaders="true" showtrailers="true" showWarnings="true" >
create table my_data as select * from csvread('my_file.csv');
select *
from my_data a
join (
select * from my_data where sex = 'M'
) b on b.height < a.height
where a.sex = 'F'
</sql>
</target>
</project>
下载并解压Apache Ant 1.10.14(或其他版本)到文件夹apache-ant-1.10.14/
下。然后下载该文件夹中的H2数据库jar文件。你的目录应该是这样的:
apache-ant-1.10.14/
h2-2.1.214.jar
my_file.csv
script1.xml
然后,运行它:
apache-ant-1.10.14/bin/ant -f script1.xml
第一个 SQL 语句将 CSV 数据加载到内存中。第二个是您的“复杂”查询:
[sql] Executing commands
[sql] NAME,SEX,AGE,HEIGHT,WEIGHT,NAME,SEX,AGE,HEIGHT,WEIGHT
[sql] Elly,F,30,70,124,Bert,M,42,66,166
[sql] Elly,F,30,70,124,Omar,M,38,69,145
[sql] Page,F,31,67,135,Bert,M,42,66,166
[sql]
[sql] 2 of 2 SQL statements executed successfully
BUILD SUCCESSFUL
Total time: 0 seconds
就是这样!
注释:
对于变量查询字符串,您可以将其外部化到文件中,然后使用 <transaction src="command.sql" />
而不是我包含的嵌入式 SQL。您可以根据需要使用多个标签。
对于变量 CSV 文件名(或任何参数值),您可以添加 -Dcsvfile=my_file.csv
在命令行中,然后在脚本中将其用作 ${csvfile}
。您可以根据需要定义许多参数。
H2 根据定义不是系统级安装的数据库,而是嵌入式数据库。不过,您可以将 JAR 文件放置在您想要的任何位置,然后使用 <classpath>
标签来引用系统类路径,而不是更简单的 classpath
本例中的属性。请参阅Ant -> Ant 任务 -> 任务列表 -> Sql 和 <classpath>
了解详情。
作为一个数据库,H2是相当强大的。我将其 SQL 支持评定为中高,因此它实现了您在昂贵的数据库中可以找到的大多数常见 SQL 语法和功能。
请注意,SQL 查询使用 XML 格式嵌入到脚本中。这就是为什么 <
符号转义为 <
。如果您不喜欢这样,可以使用 <transaction>
将查询放入外部文件中(无需转义)标签。
您还可以将结果输出为 CSV 或其他格式,以供进一步处理或供其他工具使用。
关于sql - 从命令行对 CSV 文件内容运行 SQL 查询?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/76953964/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!