- android - 多次调用 OnPrimaryClipChangedListener
- android - 无法更新 RecyclerView 中的 TextView 字段
- android.database.CursorIndexOutOfBoundsException : Index 0 requested, 光标大小为 0
- android - 使用 AppCompat 时,我们是否需要明确指定其 UI 组件(Spinner、EditText)颜色
我看到有几个相关的问题和答案,但不完全是我需要的,所以我会问一个新问题。我有这个包含数千行商店库存数据的 CSV 文件,我想将这些数据导入到 MS SQL Server 数据库中并使用 SQL 来处理它们。导入 CSV 文件后,SQL 表将具有包含 CSV 数据的三列。问题是我需要将此 CSV 数据放入单独的行中以便对其进行更多分析。我想最终得到两个表:通过导入 CSV 文件创建的原始表,以及通过拆分 CSV 文件创建的表。这是两个表的外观的表示:
/Table1 (the original CSV file). First row is column names:
StoreID,Date,StoreName,City,State,Category1CSV,Category2CSV,Category3CSV
1051,2/16/2014,Easton,Columbus,OH,"Flour,Yeast,Baking Powder","Milk,Water,Oil","Cinnamon,Sugar"
1425,1/14/2014,Crocker Park,Westlake,OH,"Baking Powder,Yeast,Flour","Oil,Milk,Water","Rosemay,Cinnamon,Sugar"
/Table2 (after splitting the CSV column contents). First row is column names:
StoreID,Date,StoreName,City,State,ItemName,ItemRank,ItemCategory
1051,2/16/2014,Easton,Columbus,OH,Flour,1,1
1051,2/16/2014,Easton,Columbus,OH,Yeast,2,1
1051,2/16/2014,Easton,Columbus,OH,Baking Powder,3,1
1051,2/16/2014,Easton,Columbus,OH,Milk,4,2
1051,2/16/2014,Easton,Columbus,OH,Water,5,2
1051,2/16/2014,Easton,Columbus,OH,Oil,6,2
1051,2/16/2014,Easton,Columbus,OH,Cinnamon,7,3
1051,2/16/2014,Easton,Columbus,OH,Sugar,8,3
1425,1/14/2014,Crocker Park,Westlake,OH,Baking Powder,1,1
1425,1/14/2014,Crocker Park,Westlake,OH,Yeast,2,1
1425,1/14/2014,Crocker Park,Westlake,OH,Flour,3,1
1425,1/14/2014,Crocker Park,Westlake,OH,Oil,4,2
1425,1/14/2014,Crocker Park,Westlake,OH,Milk,5,2
1425,1/14/2014,Crocker Park,Westlake,OH,Water,6,2
1425,1/14/2014,Crocker Park,Westlake,OH,Rosemary,7,3
1425,1/14/2014,Crocker Park,Westlake,OH,Cinnamon,8,3
1425,1/14/2014,Crocker Park,Westlake,OH,Sugar,9,3
SQL 列数据类型是:
Table 1
StoreID - int
Date - date
StoreName - nvarchar(50)
City- nvarchar(50)
State- nvarchar(50)
Category1CSV - nvarchar(MAX)
Category2CSV - nvarchar(MAX)
Category3CSV - nvarchar(MAX)
Table2
StoreID - int
Date - date
StoreName - nvarchar(50)
City- nvarchar(50)
State - nvarchar(50)
ItemName - nvarchar(50)
ItemRank - tinyint
ItemCategory -tinyint
标有 Category1CSV、Category2CSV 和 Category3CSV 内容的表 1 列映射到表 2 列:ItemName、ItemRank、ItemCategory,其中 ItemName 是项目(例如:面粉),ItemRank 是项目在 CSV 列表中的顺序, ItemCategory 是 1,2 或 3,具体取决于数据是来自 Category1CSV、Category2CSV 还是 Category3CSV。
这方面最重要的方面(除了拆分 CSV 列之外)是保持 CSV 列中项目的顺序。例如,StroreID 1051 的 Category1CSV 内容为“Flour,Yeast,Baking Powder”。这些将映射到 ItemName、ItemRank 和 ItemCategory 列,使得 ItemName = Flour,ItemRank = 1,ItemCategory = 1。这将是表 2 中的第一行。第二行将是 ItemName = Yeast,它是 ItemRank = 2,并且 ItemCategory = 1,依此类推,直到您得到如上表 2 所示的结果。此外,您会注意到 ItemRank 编号从 Category1CSV 列的内容开始,然后继续到 Category2CSV,最后是 Category3CSV。
在那个冗长的解释之后,是否有可能有一些 SQL 语句会为我从表 1 创建表 2?如果是这样,那会是什么样子?我打算使用 MS SQL Server Express 2012。
或者...正如有人向我建议的那样,最好在 Excel 或 Python 脚本中使用一些 VBA(可能与 Notepad++ 结合使用?)来完成此操作,然后只导入最终数据?我不在乎这两种方式,我只是不能继续手动编辑 CSV 文件,因为它非常乏味且耗时。
最佳答案
我会使用 Split 函数来拆分附加值。
我使用的 Split 函数使用一个 Numbers(一个包含数字 1 到 1,000,000 的表格)以促进拆分过程。
一旦 Numbers 表和 Split 函数就位,我将使用 CROSS APPLY 函数将 Split 应用于 CSV 列。拆分 CSV 列的代码如下所示(这只是基于您提供的数据的几个测试行)。
DECLARE @Table TABLE (val1 VARCHAR(50), val2 VARCHAR(50), val3 VARCHAR(50), csv1 VARCHAR(100), csv2 VARCHAR(100), csv3 VARCHAR(100))
INSERT INTO @Table
VALUES ('Easton', 'Columbus', 'OH', 'Flour,Yeast,Baking Powder','Milk,Water,Oil','Cinnamon,Sugar')
, ('Crocker Park', 'Westlake', 'OH', 'Baking Powder,Yeast,Flour','Oil,Milk,Water','Rosemary,Cinnamon,Sugar')
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv1, ',')
) apl
UNION ALL
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv2, ',')
) apl
UNION ALL
SELECT tbl.val1, val2, val3, apl.*
FROM @Table tbl
CROSS APPLY(
SELECT val
FROM dbo.Split(tbl.csv3, ',')
) apl
ORDER BY val1
根据样本日期,其输出将如下所示。
Crocker Park Westlake OH Baking Powder
Crocker Park Westlake OH Cinnamon
Crocker Park Westlake OH Flour
Crocker Park Westlake OH Milk
Crocker Park Westlake OH Oil
Crocker Park Westlake OH Rosemary
Crocker Park Westlake OH Sugar
Crocker Park Westlake OH Water
Crocker Park Westlake OH Yeast
Easton Columbus OH Baking Powder
Easton Columbus OH Cinnamon
Easton Columbus OH Flour
Easton Columbus OH Milk
Easton Columbus OH Oil
Easton Columbus OH Sugar
Easton Columbus OH Water
Easton Columbus OH Yeast
下面是创建 Numbers 表的代码
DECLARE @tbl TABLE (n INT)
INSERT INTO @tbl (n)
VALUES (1),(2),(3),(4),(5),(6),(7),(8),(9),(10)
; WITH Num AS(
SELECT one.n
FROM @tbl one
CROSS JOIN @tbl two
CROSS JOIN @tbl three
CROSS JOIN @tbl four
CROSS JOIN @tbl five
CROSS JOIN @tbl six
)
SELECT ROW_NUMBER() OVER(ORDER BY n) AS n
INTO dbo.Numbers
FROM Num
ALTER TABLE dbo.Numbers
ALTER COLUMN n INT NOT NULL
ALTER TABLE dbo.Numbers
ADD PRIMARY KEY (n)
GO
最后,这里是创建 Split 函数的代码。
CREATE FUNCTION dbo.Split
(
@List VARCHAR(MAX),
@Delimiter VARCHAR(255)
)
RETURNS TABLE
AS
RETURN
(
SELECT val = SUBSTRING(@List, n, CHARINDEX(@Delimiter, @List + @Delimiter, n) - n)
FROM dbo.Numbers
WHERE n <= CONVERT(INT, LEN(@List))
AND SUBSTRING(@Delimiter + @List, n, LEN(@Delimiter)) = @Delimiter
);
GO
关于python - 我可以使用 SQL 将存储为 CSV(逗号分隔值)的表列的内容拆分为新表中的各个行吗?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/29039410/
SQL、PL-SQL 和 T-SQL 之间有什么区别? 谁能解释一下这三者之间的区别,并提供每一个的相关使用场景? 最佳答案 SQL 是一种对集合进行操作的查询语言。 它或多或少是标准化的,几乎所有关
这个问题已经有答案了: What is the difference between SQL, PL-SQL and T-SQL? (6 个回答) 已关闭 9 年前。 我对 SQL 的了解足以完成我的
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列有一个默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任
我有一个可能属于以下类型的字符串 string expected result 15-th-rp 15 15/12-rp 12 15-12-th
很难说出这里问的是什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或言辞激烈,无法以目前的形式合理回答。如需帮助澄清此问题以便可以重新打开,visit the help center . 9年前关闭
我有一个存储过程(称为 sprocGetArticles),它从文章表中返回文章列表。这个存储过程没有任何参数。 用户可以对每篇文章发表评论,我将这些评论存储在由文章 ID 链接的评论表中。 有什么方
我目前正在做一个 *cough*Oracle*cough* 数据库主题。讲师介绍embedded SQL作为让其他语言(例如 C、C++)与(Oracle)数据库交互的方式。 我自己做了一些数据库工作
SQL Server 中 SQL 语句的最大长度是多少?这个长度是否取决于 SQL Server 的版本? 例如,在 DECLARE @SQLStatement NVARCHAR(MAX) = N'S
这个问题已经有答案了: Simple way to transpose columns and rows in SQL? (9 个回答) 已关闭 8 年前。 CallType
预先感谢您对此提供的任何帮助。 假设我有一个查询,可以比较跨年的数据,从某个任意年份开始,永无止境(进入 future ),每年同一时期直到最后一个完整的月份(其特点是一月数据永远不会显示至 2 月
我在数据库中有一个 USER 表。该表有一个 RegistrationDate 列,该列的默认约束为 GETDATE()。 使用 LINQ 时,我没有为 RegistrationDate 列提供任何数
下面是我试图用来检查存储过程是否不存在然后创建过程的 sql。它会抛出一个错误:Incorrect syntax near the keyword 'PROCEDURE' IF NOT EXISTS
我有一个同事声称动态 SQL 在许多情况下比静态 SQL 执行得更快,所以我经常看到 DSQL 到处都是。除了明显的缺点,比如在运行之前无法检测到错误并且更难阅读,这是否准确?当我问他为什么一直使用
来自 lobodava 的动态 SQL 查询是: declare @sql nvarchar(4000) = N';with cteColumnts (ORDINAL_POSITION, CO
使用 SQL Server 中的存储过程执行动态 SQL 命令的现实优点和缺点是什么 EXEC (@SQL) 对比 EXEC SP_EXECUTESQL @SQL ? 最佳答案 sp_executes
我有这个有效的 SQL 查询: select sum(dbos.Points) as Points, dboseasons.Year from dbo.StatLines dbos i
我正在调试一些构建成功运行的 SQL 命令的代码。 然而,在查询结束时,查询结果似乎被写入了一个文本文件。 完整的查询如下 echo SELECT DATE,DATETABLE,DATE,APPDAT
我有一些创建表的 .sql 文件(MS SQL 数据库): 表_1.sql: IF OBJECT_ID (N'my_schema.table1', N'U') IS NOT NULL DROP TAB
我写了下面的 SQL 存储过程,它一直给我错误@pid = SELECT MAX(... 整个过程是: Alter PROCEDURE insert_partyco @pname varchar(20
我在 SQL Server 2005 中有包含两列 Fruit 和 Color 的表,如下所示 Fruit Colour Apple Red Orange
我是一名优秀的程序员,十分优秀!