- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我遇到了由错误查询导致的数据丢失问题。
数据已恢复,但现在我想了解问题所在。
我在 SQL Server 2014 上遇到了这个问题,但我在 SQL Server 2000 和 PostgreSQL 上复制了它。具体来说,有一个DELETE。在以下场景中,我使用了 SELECT。
sql server 2014 的表创建:
CREATE TABLE [dbo].[tmp_color](
[color_id] [int] NOT NULL,
[color_name] [nvarchar](50) NOT NULL,
[color_cat] [int] NOT NULL,
CONSTRAINT [PK_tmp_color] PRIMARY KEY CLUSTERED (
[color_id] ASC
) WITH (PAD_INDEX = OFF, STATISTICS_NORECOMPUTE = OFF, IGNORE_DUP_KEY = OFF
, ALLOW_ROW_LOCKS = ON, ALLOW_PAGE_LOCKS = ON) ON [PRIMARY]
) ON [PRIMARY]
CREATE TABLE [dbo].[tmp_color_cat](
[catid] [int] NOT NULL,
[catname] [nvarchar](50) NOT NULL,
CONSTRAINT [PK_tmp_color_cat] PRIMARY KEY CLUSTERED (
[catid] ASC
) WITH (PAD_INDEX = OFF, STATISTICS_NORECOMPUTE = OFF, IGNORE_DUP_KEY = OFF
, ALLOW_ROW_LOCKS = ON, ALLOW_PAGE_LOCKS = ON) ON [PRIMARY]
) ON [PRIMARY]
和 Postgres 版本:
CREATE TABLE tmp_color (
color_id integer NOT NULL,
color_name text,
color_cat integer,
CONSTRAINT tmp_color_pkey PRIMARY KEY (color_id)
);
CREATE TABLE tmp_color_cat (
catid integer NOT NULL,
catname text,
CONSTRAINT tmp_color_cat_pkey PRIMARY KEY (catid)
);
数据填充(适用于两个 RDBMS):
INSERT INTO tmp_color_cat (catid, catname) VALUES (1, 'magic color');
INSERT INTO tmp_color_cat (catid, catname) VALUES (2, 'normal color');
INSERT INTO tmp_color (color_id, color_name, color_cat) VALUES (1, 'red', 1);
INSERT INTO tmp_color (color_id, color_name, color_cat) VALUES (2, 'green', 2);
INSERT INTO tmp_color (color_id, color_name, color_cat) VALUES (3, 'black', 1);
以下 SELECT 是错误的:
SELECT color_cat
FROM tmp_color_cat;
因为 color_cat
不存在于 tmp_color_cat
中。
但是,当您在子查询中使用它时:
SELECT * FROM tmp_color
WHERE color_cat IN(
SELECT color_cat
FROM tmp_color_cat
WHERE catname = 'magic color'
);
它从tmp_color
返回每条记录。
脚本中的逻辑错误很明显:开发人员编写了错误的列来标识类别。如果您要删除记录而不是选择它们,您将删除整个表格。不好。
这是期望的行为吗?还是子查询设计的结果?
通过观察SQL Server的执行计划,逻辑操作是Left Semi Join。
我找到了几个帖子,一个 for PostgreSQL和一个for SQL Server .我可以向开发人员组发送任何好的文档来解释为什么这不是错误吗?
如何避免此类问题?我的第一个想法是使用别名。别名很好。
最佳答案
子查询的范围包括外部查询的所有可见列。不合格的名称首先解析到内部查询,然后向外扩展搜索。
分配表别名并使用这些别名对列名进行表限定以消除任何歧义 - 正如您已经暗示过的那样。
这是一个 example in the Postgres manual with a definitive statement explaining the scope :
SELECT ... FROM fdt WHERE c1 IN (SELECT c3 FROM t2 WHERE c2 = fdt.c1 + 10)
[...]
Qualifying
c1
as fdt.c1 is only necessary ifc1
is also the name of a column in the derived input table of the subquery. But qualifying the column name adds clarity even when it is not needed. This example shows how the column naming scope of an outer query extends into its inner queries.
大胆强调我的。
手册同一章的示例列表中还有一个带有EXISTS
半连接的示例。这通常是 WHERE x IN(子查询)
的高级替代。但在这种特殊情况下,您也不需要。见下文。
一个例子:
这场灾难的发生是因为对列名的混淆。表格定义中的清晰且一致的命名约定将大大降低这种情况发生的可能性。这适用于任何 RDBMS。让它们尽可能长以便清楚,但尽可能短。无论您的政策如何,都要保持一致。
对于 Postgres,我建议:
CREATE TABLE colorcat (
colorcat_id integer NOT NULL PRIMARY KEY,
colorcat text UNIQUE NOT NULL
);
CREATE TABLE color (
color_id integer NOT NULL PRIMARY KEY,
color text NOT NULL,
colorcat_id integer REFERENCES colorcat -- assuming an FK
);
您已经有了合法的、小写的、不带引号的标识符。这很好。
使用一致的政策。不一致的政策比糟糕的政策更糟糕。不是 color_name
(带下划线)与 catname
。
我很少在标识符中使用“名称”。它不添加信息,只是使它们更长。所有标识符都是名称。您选择了 cat_name
,留下了实际上携带信息的 color
,并添加了没有携带信息的 name
。如果您的数据库中有其他“类别”(这很常见),您将拥有多个 cat_name
,它们很容易在更大的查询中发生冲突。我宁愿使用 colorcat
(就像表名一样)。
使名称指示列中的内容。对于颜色类别的 ID,colorcat_id
是一个不错的选择。 id
不是描述性的,colorcat
会产生误导。
FK 列 colorcat_id
可以与引用列同名。两者的内容完全相同。还允许在连接中使用 USING
的简短语法。
包含更多详细信息的相关答案:
基于我假设的设计:
SELECT c.*
FROM colorcat cc
JOIN color c USING (colorcat_id)
WHERE cc.colorcat = 'magic color';
这是假设 colorcat
和 color
之间的 1:n 关系(您没有指定,但似乎有可能)。
鲜为人知(因为语法在 SQL Server 等其他 RDBMS 中不同),您可以 join in additional tables in a DELETE
还有:
DELETE FROM color c
USING colorcat cc
WHERE cc.colorcat = 'magic color'
AND cc.colorcat_id = c.colorcat_id;
关于sql - 子查询中错误命名的字段导致加入,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/31265453/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!