- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我已经花了相当多的时间在谷歌上搜索这个,但我似乎无法将自己指向我正在寻找的正确方向。我的 .csv 文件的问题是,虽然行终止符是 ',,,,',但有些行不包含此内容,因此当我导入文件时,它很好,直到它到达其中一个,但随后它会处理它作为一条记录,它的长度大约是标准记录应具有的列数的两倍,然后从那时起就被抛弃了。我需要做的是跳过超过正确列数 (15) 的记录(',,,,' 终止符之间的数据)。我意识到每次发生这种情况时,这基本上都会跳过 2 条记录,但这对于我处理相当大的数据集的目的来说很好。
我遇到过 IGNORE 关键字,但它似乎并不适用。我正在寻找的是这样的:对于导入期间的每条记录,如果 record.columns.count > 15,则跳过记录。这是我的导入语句,感谢您提供的任何帮助。
LOAD DATA LOCAL INFILE "/Users/foo/Desktop/csvData.csv"
INTO TABLE csvData
COLUMNS TERMINATED BY ','
OPTIONALLY ENCLOSED BY '"'
ESCAPED BY '"'
LINES TERMINATED BY ',,,,';
最佳答案
如果你只想跳过格式错误的记录,一个简单的 awk 命令只过滤好的记录是:
awk -F, '{ if (NF == 15) print; }' csvData.csv > csvData_fixed.csv
然后从固定文件LOAD DATA
。
如果你想更有趣,你可以使用 awk(或 Python 或任何你喜欢的)编写脚本,以正确的格式重写格式错误的记录。
关于您的评论:awk 命令读取您的原始文件并仅输出恰好有 15 个字段的每一行,其中字段以逗号分隔。
显然您的输入数据没有恰好有 15 个字段的行,即使您是这样描述的。
另一个想法:在您原来的 LOAD DATA 命令中使用行终止符 ',,,,' 有点奇怪。通常行终止符是'\n',这是一个换行符。因此,当您将行终止符重新定义为 ',,,,' 时,这意味着 MySQL 将继续读取文本,直到它找到 ',,,,',即使最终会在多行文本中读取数十个字段。也许您可以将行终止符设置为 ',,,,\n'。
关于MySQL加载数据InFile;如果跳过行,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/39359663/
我的算法- private static MyList skip$DeleteItem(MyList L , int M , int N){ MyList curr = L; MyLi
我正在 SWI-Prolog 下开发,但我的目标是 Erlog (https://github.com/rvirding/erlog)。我需要一种使用非标准 Prolog 语法的方法。 有没有办法
我正在尝试从应用程序下载一大堆文件。它的shell命令是“下载文件名”。 我有一个文本文件,其中包含必须下载的所有文件名。我要做的就是运行一个脚本/命令,以便在执行上述命令时 1.从文本文件中提取文件
我试图循环遍历所有用户的评论,但使用 if 语句查找特定值。问题是我的应用程序崩溃了,因为一些用户没有发表评论,因此我得到“无法读取‘收集’未定义的属性”。如何跳过 if 语句的未定义值?代码如下:
我们有按年份分区的索引,例如: items-2019 items-2020 考虑以下数据: POST items-2019/_doc { "@timestamp": "2019-01-01" }
我只是编写一个页面来按实体编号查看每个 ASCII 条目,我想知道是否有一种更简单/更干净的方法来跳过不需要的数字。 var x = new Ar
我希望能够普遍使用重复条目,但也能够跳过特定日期。例子: ** TODO swim practice SCHEDULED 但是,我提前知道 2013-12-25 不会有练习。但是,当我将项目标
如何跳过像这样的 for 循环的一次迭代: for (int i = 65; i <= 90; i++) { if (!(i == 73)) { uniq.add((char) i);
这个问题已经存在: Scanner issue when using nextLine after nextXXX [duplicate] 已关闭 9 年前。 ask=1; while(ask==1)
我在使用一个程序时遇到了一些麻烦,我应该允许用户在程序中输入任意数量的数字,直到他们不再想要为止。然后程序应该计算输入数字的平均值和最大值。我哪里做错了? import java.util.Scann
我有一个名为segments的 Sprite 数组,我想在每个循环中跳过segments的第一个元素。我目前正在这样做: var first = true; for each (var segment
我目前正在编写一个 for 循环来遍历包含 38 个元素的 2D。然而,其中一些元素为空,我希望 for 循环简单地跳过它们(因为在我正在解决的难题中,它们没有与它们相关的移动)。快速搜索表明,我可以
我想使用pre-commit处理我的 git 项目的 git hooks。但是,当我使用它时,git commit 命令不断跳过 unittest 执行: (smartexchange) trnboo
这个问题在这里已经有了答案: Does scanf() take '\n' as input leftover from previous scanf()? (1 个回答) 关闭 9 年前。 我正在
我正在迭代 csv 文件中的每一行,并仅选择/计算满足条件的行。但是,当连续出现错误时,它会停止循环。有没有办法告诉 python 跳过错误并移动到下一行?我使用了 try 函数但没有工作。我的代码是
感谢您提供的优秀示例,我试过了,它按我的预期工作。很高兴看到有人了解问题的本质。但是,我认为我应该用 Lift 标记问题,因为我正在使用 Lift 框架,这就是(仍然)发生这个问题的地方(尽管我仍然认
大家好,我正在编写一个算法来从 NodeTree 中删除具体分支(例如 DSF)。如果您选择 Node 的名称,算法将检查该 Node 是否是其他 Node 的父 Node ;如果是,它会获取该 No
附有代码和输出。 基本上它是第二次跳过我的输入。就像我启动代码一样,它让我输入一个选项,然后第二次跳过输入,直接转到开关的默认情况。 然后第三次它就会允许我输入。不明白为什么。 任何帮助将不胜感激。
我在 JavaScript 中有一个 for 循环,它会定期跳过间隔,但我无法确定原因。 console.log(parseInt($('input.num-to-add').val())); num
我正在 JasperSoft 中填写参数。在我的报告中我有参数:参数_1、参数_2、参数_3 int a; for (a = 0; a < headers.length; a++) {
我是一名优秀的程序员,十分优秀!