- iOS/Objective-C 元类和类别
- objective-c - -1001 错误,当 NSURLSession 通过 httpproxy 和/etc/hosts
- java - 使用网络类获取 url 地址
- ios - 推送通知中不播放声音
cat/tac
、grep/sed
、head/tail
、cut
、 等工具sort/uniq
、comm
和 join
链接在一起时,可以轻松地从一个或多个文件中提取数据。在这种情况下,主导范例是创建“管道”或应用“过滤器”来提取信息。
我在想,关系运算符的不同观点在应用于文本文件时可能会有用,至少作为一个概念框架,可以帮助我更好地利用和组合这些工具来提取和转换数据。
我的问题是:有人可以给我一些示例来说明关系运算符/SQL 查询和 Unix 过滤管道之间的类比吗?
为了使其更具体和更有用,我在这里提供了两个用 StackExchange Data Explorer 创建的以空格分隔的表格数据集。 ,包含数值、标称值和序数值:
$ cat so_tag_rank.txt
Tag Group MayRank TotalRank QuestionsInMay QuestionsTotal
javascript Lang 1 2 25111 869428
java Lang 2 1 21331 870935
android Platform 3 5 17351 682459
php Lang 4 4 16910 761350
c# Lang 5 3 15296 805666
jquery Library 6 6 12950 621883
python Lang 7 7 12394 434282
html Markup 8 8 11672 422871
ios Platform 9 10 9465 340714
css Style 10 12 8141 310651
$ cat so_upvote_ratio.txt
Tags Group Upvotes Downvotes UD_ratio
c# Lang 3692949 110750 3
java Lang 3643245 112450 3.09
javascript Lang 3326801 122302 3.68
c++ Lang 2247424 71309 3.17
python Lang 2227963 59990 2.69
php Lang 2177780 106569 4.89
android Platform 2094791 59973 2.86
jquery Library 2054170 68602 3.34
html Markup 1444111 67129 4.65
.net Platform 1334296 38208 2.86
为了简单起见,让我们指定我们不关心命名列(您可以忽略标题并按位置指定列 - 可以使用 shell 脚本中的变量模拟符号名称)。
我会对使用一个或多个命令的单行程序/脚本感兴趣:cat/tac
、grep
、sed
、awk
, head/tail
, cut
, sort
, uniq
, comm
、diff
、join
、rev
、tee
、paste
sh/bash shell,模拟下面的一些SQL命令/关系操作:
选择、投影、并集
SELECT [DISTINCT] select_expr [FROM file_refs]
[WHERE where_condition] | [WHERE_IN strlist]
[GROUP BY {col | expr}]
[HAVING where_condition]
[ORDER BY {col | expr} [ASC | DESC]]
[LIMIT {num_rows OFFSET offset}]
UNION [ALL | DISTINCT] SELECT ...(sub-query)..
连接/产品:
[LEFT | RIGHT] [INNER | OUTER] JOIN [ON {on_expression} | USING {using_expression}]
功能与比较
Aggregation : CONCAT, COUNT, SUM, MAX, MIN, AVG, MEDIAN, MODE, INDEXOF_MAX, INDEXOF_MIN
Comparison : =,>,<, LIKE/NOT LIKE, NULL/NOT NULL, IN/NOT IN, Dates comparison
Boolean operators : AND,OR,NOT,XOR
高级操作
Band/Range JOIN, Self JOIN
Views (Temporary files?), Difference/Except, Division
Sub-queries/Nested queries
Contingency tables
在这种情况下,我更喜欢创造力而不是便携性。
最佳答案
关系模型被认为是一种通用数据管理工具。因此,它有足够的能力和强大的能力来表达,基本上,一切。
因此,在 *ix 管道命令中可表达/可执行的内容是 RA 中可表达/可执行内容的适当子集。 (但请注意,RA 要求您正在处理的内容具有已声明的关系结构,而 *ix 命令的输出则不需要。)
例如,FIND 过滤器(对于这个古老的 DOS 示例很抱歉)有点类似于 WHERE X LIKE '%myfind%',显然是一个限制。
例如,流水线本身有点类似于关系运算符嵌套。
但老实说,RA 支持的大多数操作似乎在命令集中没有或多或少的直接对应项。
关于sql - 从 SQL/关系代数类比到 *nix 命令行过滤器/工具,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/30905824/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!