- python中eof表示什么语句错误
- python中for语句涉及的序列
- python中if是循环语句吗
- python中if语句与或非
Python csv模块:处理csv文件
csv 文件本质上是文本文件,用来保存表格数据,它使用逗号来分隔行内的单元,使用换行符来分隔不同的行。下面是一个普通的 csv 文件,包含两行和两列,内容如下:
第一行第一列,第一行第二列 第二行第一列,第二行第二列
在 Excel 中的显示效果如图 1 所示。
如果某个单元格中包含“,”分隔符,那么它将使用双引号将单元格的内容包裹起来。如下面的 csv 文件内容就是包裹有“,”分隔符的情形。
“包括,的单元”,第一行第二列 第二行第一列,第二行第二列
注意,第一行第一列是用双引号包裹的,显示效果如图 2 所示。
如果某个单元格包含多行,也是将该单元格的内容包裹在双引号内。例如,下面的 csv 文件的第一行第一列就包含多行。
“包含换行符的单元 第2行 第三行”,第一行第二列 第二行第一列,第二行第二列
在 Excel 中的显示效果如图 3 所示。
如果单元格的内容包含双引号呢?其还是用双引号来包裹,内容中的双引号用两个连续的双引号来表示。例如下面的csv文件的第一行第一列就包含“””字符:
可以看出 csv 文件的格式还是比较简单的,通过“,”和“””就能完整表示一个仅包含文本内容的表格数据。在 Python 中,可以不通过操作文本文件的方式来对 csv 文件进行处理,因为其可以通过很多库来直接操作单元格内容,而不用关心 csv 文件格式的细节。本节将介绍一个比较常见的处理 csv 文件的模块——csv。
csv 模块是 Python 的一个内置模块,不需要安装只需要在使用之前将其引入即可,方式如下:
import csv
对 csv 文件的操作主要有两个,一个是读入,一个是写出。首先来介绍读入,在 csv 模块中有一个类 reader,该类实例对象是可迭代的,就是可以用 for…in… 语句来变量所有的 csv 的行。同时其还有一个属性 line_num,表示当前读入的行号。
下面以图 1 所示的 csv 文件为例来演示相关操作:
>>> import csv # 引入csv模块 >>> reader_obj = csv.reader(open('demo1.csv', 'r', encoding="utf-8")) >>> for line in reader_obj: # 对每行进行操作 ... print("line number: %d" % reader_obj.line_num) # 显示当前行号 ... print("content: %s" % str(line)) # 显示当前行的内容 ... print("") # 输出换行 ... # 结束for循环 line number: 1 # 行号为1 content: ['第一行第一列', '第一行第二列'] # 内容为列表 # 第6行的输出 line number: 2 # 行号为2 content: ['第二行第一列', '第二行第二列'] # 第二行的内容
下面是一个查找诈骗电话的例子。诈骗电话有这样一个特点,就是这些电话仅往外拨,从来不接听别人的电话。现在我们拿到一个完整的通话记录,内容显示如图 5 所示。
其中第一列是呼叫方的号码,第二列是被叫方的电话号码,第三列是呼叫开始的时间,第四列是通话时长。我们希望通过这些数据来找到其中的诈骗电话号码。我们依次读出所有的行,然后在呼叫方号码列表中查找没有出现在被叫方号码列表的号码,它们就可能是诈骗电话号码。
实现代码如下:
import sys, csv # 打开通话记录文件 if sys.version_info.major == 3: # python3 f = open("telephone.csv", "r",encoding="utf-8", newline="\n") else: # Python 2 f = open("telephone.csv", "r") reader = csv.reader(f) caller_list = [] # 呼叫方号码列表 callee_list = [] # 被叫方号码列表,最开始都为空 for record in reader: # 对每个记录进行处理 # 第一行是表头,不进行处理 if reader.line_num == 1: continue caller_list.append(record[0]) # 记录下所有的呼叫号码 # 记录下所有的被呼叫号码 callee_list.append(record[1]) caller_list = set(caller_list) # 去掉重复的呼叫号码 f.close() # 关闭文件 # 对于每个呼叫号码 for caller in caller_list: # 如果它没有被呼叫过,那么标定为骗子号码 if caller not in callee_list: print(caller, "is Cheat Telephone Number")
运行后的输出如下:
$ python cheatTel1.py 13243767000 is Cheat Telephone Number
下面我们来介绍将数据输出到 csv 文件中的方法。在 csv 模块中有一个 writer 类,其提供 writerow() 和 writerows() 两个接口函数。使用这两个接口函数便可以将列表数据输出到 csv 文件中。
下面是一个简单的例子,其使用 writerow() 来产生一个 csv 文件:
import csv csv_writer_obj = csv.writer(open("writeDemo1.csv", "w")) csv_writer_obj.writerow(("a", "b", 12, 24.6))
输出文件 writeDemo1.csv 的内容在 Excel 中的显示如图 6 所示。
在输出时并不要求每行的列数相同,例如下面的代码,其输出了三行,这三行的列数分别为 4、2、3。
import csv csv_writer_obj = csv.writer(open("writeDemo2.csv", "w")) csv_writer_obj.writerow(("a", "b", 12, 24.6)) csv_writer_obj.writerow(("c", "d")) csv_writer_obj.writerow(("e", "", "1"))
输出 csv 文件,内容如图 7 所示。
另外一个接口函数是 writerows(),顾名思义,该接口函数可以一次写入多行。下面的例子便是将一个列表写入到 csv 文件中。
import csv data = [ # 列表,每个元素代表一行 ["a", "b", "c"], ["d", "e", "f"], ] csv_writer_obj = csv.writer(open("writeDemo3.csv", "w")) csv_writer_obj.writerows(data)
输出 csv 文件,内容如图 8 所示。
我最近在我的机器上安装了 cx_Oracle 模块,以便连接到远程 Oracle 数据库服务器。 (我身边没有 Oracle 客户端)。 Python:版本 2.7 x86 Oracle:版本 11.
我想从 python timeit 模块检查打印以下内容需要多少时间,如何打印, import timeit x = [x for x in range(10000)] timeit.timeit("
我盯着 vs 代码编辑器上的 java 脚本编码,当我尝试将外部模块包含到我的项目中时,代码编辑器提出了这样的建议 -->(文件是 CommonJS 模块;它可能会转换为 ES6 模块。 )..有什么
我有一个 Node 应用程序,我想在标准 ES6 模块格式中使用(即 "type": "module" in the package.json ,并始终使用 import 和 export)而不转译为
我正在学习将 BlueprintJS 合并到我的 React 网络应用程序中,并且在加载某些 CSS 模块时遇到了很多麻烦。 我已经安装了 npm install @blueprintjs/core和
我需要重构一堆具有这样的调用的文件 define(['module1','module2','module3' etc...], function(a, b, c etc...) { //bun
我是 Angular 的新手,正在学习各种教程(Codecademy、thinkster.io 等),并且已经看到了声明应用程序容器的两种方法。首先: var app = angular.module
我正在尝试将 OUnit 与 OCaml 一起使用。 单元代码源码(unit.ml)如下: open OUnit let empty_list = [] let list_a = [1;2;3] le
我在 Angular 1.x 应用程序中使用 webpack 和 ES6 模块。在我设置的 webpack.config 中: resolve: { alias: { 'angular':
internal/modules/cjs/loader.js:750 return process.dlopen(module, path.toNamespacedPath(filename));
在本教程中,您将借助示例了解 JavaScript 中的模块。 随着我们的程序变得越来越大,它可能包含许多行代码。您可以使用模块根据功能将代码分隔在单独的文件中,而不是将所有内容都放在一个文件
我想知道是否可以将此代码更改为仅调用 MyModule.RED 而不是 MyModule.COLORS.RED。我尝试将 mod 设置为变量来存储颜色,但似乎不起作用。难道是我方法不对? (funct
我有以下代码。它是一个 JavaScript 模块。 (function() { // Object var Cahootsy; Cahootsy = { hello:
关闭。这个问题是 opinion-based 。它目前不接受答案。 想要改进这个问题?更新问题,以便 editing this post 可以用事实和引文来回答它。 关闭 2 年前。 Improve
从用户的角度来看,一个模块能够通过 require 加载并返回一个 table,模块导出的接口都被定义在此 table 中(此 table 被作为一个 namespace)。所有的标准库都是模块。标
Ruby的模块非常类似类,除了: 模块不可以有实体 模块不可以有子类 模块由module...end定义. 实际上...模块的'模块类'是'类的类'这个类的父类.搞懂了吗?不懂?让我们继续看
我有一个脚本,它从 CLI 获取 3 个输入变量并将其分别插入到 3 个变量: GetOptions("old_path=s" => \$old_path, "var=s" =
我有一个简单的 python 包,其目录结构如下: wibble | |-----foo | |----ping.py | |-----bar | |----pong.py 简单的
这种语法会非常有用——这不起作用有什么原因吗?谢谢! module Foo = { let bar: string = "bar" }; let bar = Foo.bar; /* works *
我想运行一个命令: - name: install pip shell: "python {"changed": true, "cmd": "python <(curl https://boot
我是一名优秀的程序员,十分优秀!