Windows下Python使用Pandas模块操作Excel文件的教程-6ren

Windows下Python使用Pandas模块操作Excel文件的教程

转载作者：qq735679552 更新时间：2022-09-29 22:32:09

28

4

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章Windows下Python使用Pandas模块操作Excel文件的教程由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

安装Python环境 ANACONDA是一个Python的发行版本，包含了400多个Python最常用的库，其中就包括了数据分析中需要经常使用到的Numpy和Pandas等。更重要的是，不论在哪个平台上，都可以一键安装，自动配置好环境，不需要用户任何的额外操作，非常方便。因此，安装Python环境就只需要到ANACONDA网站上下载安装文件，双击安装即可。 ANACONDA官方下载地址：https://www.continuum.io/downloads 安装完成之后，使用windows + r键打开Windows命令行，输入ipython，然后回车:

Python 2.7.11 |Anaconda 2.5.0 (64-bit)| (default, Jan 29 2016, 14:26:21) [MSC v.1500 64 bit (AMD64)]Type "copyright", "credits" or "license" for more information.IPython 4.0.3 -- An enhanced Interactive Python.?     -> Introduction and overview of IPython's features.%quickref -> Quick reference.help   -> Python's own help system.object?  -> Details about 'object', use 'object??' for extra details.

如上所示，如果成功进入了Python环境，则代表安装成功.

使用pandas处理excel 在本文我以log.xls文件为例，来说明如何使用pandas处理excel文件。log.xls文件的内容如下所示:

Windows下Python使用Pandas模块操作Excel文件的教程

可以看到log.xls中包含了多个的表（sheet），每个表主要包括了member和activity两个属性，相同的member ID的数据相邻的排列在一起，并且最后一行是前面所有的汇总。这里，我们假设需要提取出每个member汇总的信息，即提取每个member连续出现的最后一行的数据。如何实现呢?

这里我们就来隆重介绍Pandas,，从https://pypi.python.org/pypi/pandas/0.16.2官方下载，cmd命令行进入下载解压目录，。

python setup.py install

安装.

（PS：python的大数据模块pandas完全安装完毕后还依赖于 • NumPy: 1.6.1 or higher • python-dateutil 1.5 • pytz 这三个模块也许要安装。可选择依赖有(可以根据需要安装) • SciPy: miscellaneous statistical functions • PyTables: necessary for HDF5-based storage • SQLAlchemy: for SQL database support. Version 0.8.1 or higher recommended. • matplotlib: for plotting • statsmodels – Needed for parts of pandas.stats • openpyxl, xlrd/xlwt – openpyxl version 1.6.1 or higher, but lower than 2.0.0 – Needed for Excel I/O • XlsxWriter – Alternative Excel writer. • boto: necessary for Amazon S3 access. 。

）。

导入pandas模块:

import pandas as pd

使用import读入pandas模块，并且为了方便使用其缩写pd指代.

读入待处理的excel文件:

df = pd.read_excel('log.xls')

通过使用read_excel函数读入excel文件，后面需要替换成excel文件所在的路径。读入之后变为pandas的DataFrame对象。DataFrame是一个面向列(column-oriented)的二维表结构，且含有列表和行标，对excel文件的操作就转换为对DataFrame操作。另外，如果一个excel含有多个表，如果你只想读入其中一个可以:

df = pd.read_excel('log.xls', sheetname=1)

增加了一个参数sheetname，表示的是第几个表，从0开始计数。我上面设置的是1，也就是第二个表.

读入之后，可以先查看表头信息和每一列的数据类型:

df.dtypes

输出如下:

Member     objectUnnamed: 1  float64Unnamed: 2  float64Unnamed: 3  float64Unnamed: 4  float64Unnamed: 5  float64家内外活动类型    objectUnnamed: 7   objectactivity    objectdtype: object

提取每个member连续出现的最后一行数据:

 new_df = df.drop_duplicates(subset='Member', keep='last')

以上语句的意思是根据Member字段去除掉多余的行，并且保留相同行的最后一行数据。这些就得到了每一个member最后一行的数据了，返回了经过筛选后的DataFrame.

接下来需要将处理后的结果，保存为excel文件:

out = pd.ExcelWriter('output.xls')new_df.to_excel(out)out.save()

output.xls是你要保存的文件名，可以任取；然后将DataFrame的内容保存到该文件，最后保存该文件到系统的磁盘上.

接下来，你就可以在当前目录看到一个新的文件，可以直接使用excel打开查看.

Pandas还提供了很多的API，可以根据具体的任务，查找API文档，找到合适的函数来完成任务.

附：一个完整的示例。

#coding=utf-8import pandas as pd# 读入excel文件中的第2个表df = pd.read_excel('log.xls', sheetname=1)# 查看表的数据类型print df.dtypes# 查看Member列的数据print df['Member']'''# 新建一列，每一行的值是Member列和activity列相同行值的和for i in df.index:  df['activity_2'][i] = df['Member'][i] + df['activity'][i]'''# 根据Member字段去除掉多余的行，并且保留相同行的最后一行数据new_df = df.drop_duplicates(subset='Member', keep='last')# 导出结果out = pd.ExcelWriter('output.xls')new_df.to_excel(out)out.save()

。

最后此篇关于Windows下Python使用Pandas模块操作Excel文件的教程的文章就讲到这里了,如果你想了解更多关于Windows下Python使用Pandas模块操作Excel文件的教程的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

28

4

0

文章推荐：深入理解JDK动态代理

文章推荐： Windows中安装使用Virtualenv来创建独立Python环境

文章推荐： SpringBoot配置热加载工具(devtools)笔记

文章推荐：深入理解python中的浅拷贝和深拷贝

找不到 Python 模块 "cx_Oracle"模块
我最近在我的机器上安装了 cx_Oracle 模块，以便连接到远程 Oracle 数据库服务器。 (我身边没有 Oracle 客户端)。 Python:版本 2.7 x86 Oracle:版本 11.
python - Timeit 模块 - 将参数传递给 python timeit 模块
我想从 python timeit 模块检查打印以下内容需要多少时间，如何打印， import timeit x = [x for x in range(10000)] timeit.timeit("
javascript - 我该如何修复 --> 文件是 CommonJS 模块；它可以转换为 ES6 模块
我盯着 vs 代码编辑器上的 java 脚本编码，当我尝试将外部模块包含到我的项目中时，代码编辑器提出了这样的建议 -->(文件是 CommonJS 模块；它可能会转换为 ES6 模块。 )..有什么
javascript - 如何在 ES6 模块 Node 应用程序中包含 commonjs 模块？
我有一个 Node 应用程序，我想在标准 ES6 模块格式中使用(即 "type": "module" in the package.json ，并始终使用 import 和 export)而不转译为
css - BlueprintJS 未加载其图标 CSS 模块，但能够加载核心 CSS 模块
我正在学习将 BlueprintJS 合并到我的 React 网络应用程序中，并且在加载某些 CSS 模块时遇到了很多麻烦。我已经安装了 npm install @blueprintjs/core和
javascript - 将 RequireJS 模块 (AMD) 重构为 Webpack 模块 (CommonJS)
我需要重构一堆具有这样的调用的文件 define(['module1','module2','module3' etc...], function(a, b, c etc...) { //bun
javascript - 是否使用 : var app = angular. 模块...或简单地使用 : angular. 模块(
我是 Angular 的新手，正在学习各种教程(Codecademy、thinkster.io 等)，并且已经看到了声明应用程序容器的两种方法。首先: var app = angular.module
unit-testing - 在 OCaml 中使用 OUnit 模块 - 未绑定(bind)模块 OUnit 错误
我正在尝试将 OUnit 与 OCaml 一起使用。单元代码源码(unit.ml)如下: open OUnit let empty_list = [] let list_a = [1;2;3] le
javascript - "Argument ' 模块 ' is not a function, got Object"- 使用 webpack 导入 Angular 模块
我在 Angular 1.x 应用程序中使用 webpack 和 ES6 模块。在我设置的 webpack.config 中: resolve: { alias: { 'angular':
node-modules - 内部/模块/cjs/loader.js :750 return process. dlopen(模块，path.toNamespacedPath(文件名))；
internal/modules/cjs/loader.js:750 return process.dlopen(module, path.toNamespacedPath(filename));
JavaScript 模块
在本教程中，您将借助示例了解 JavaScript 中的模块。随着我们的程序变得越来越大，它可能包含许多行代码。您可以使用模块根据功能将代码分隔在单独的文件中，而不是将所有内容都放在一个文件
JavaScript 模块
我想知道是否可以将此代码更改为仅调用 MyModule.RED 而不是 MyModule.COLORS.RED。我尝试将 mod 设置为变量来存储颜色，但似乎不起作用。难道是我方法不对？ (funct
JavaScript 模块
我有以下代码。它是一个 JavaScript 模块。 (function() { // Object var Cahootsy; Cahootsy = { hello:
angular - 模块 : when and why?
关闭。这个问题是 opinion-based 。它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引文来回答它。关闭 2 年前。 Improve
Lua极简入门指南（六）：模块
从用户的角度来看，一个模块能够通过 require 加载并返回一个 table，模块导出的接口都被定义在此 table 中（此 table 被作为一个 namespace）。所有的标准库都是模块。标
ruby 模块
Ruby的模块非常类似类,除了: 模块不可以有实体模块不可以有子类模块由module...end定义. 实际上...模块的'模块类'是'类的类'这个类的父类.搞懂了吗?不懂?让我们继续看
Perl GetOptions 模块
我有一个脚本，它从 CLI 获取 3 个输入变量并将其分别插入到 3 个变量: GetOptions("old_path=s" => \$old_path, "var=s" =
Python 模块，引用同一包中的其他模块？
我有一个简单的 python 包，其目录结构如下: wibble | |-----foo | |----ping.py | |-----bar | |----pong.py 简单的
ocaml - 无法解构仿函数(模块)
这种语法会非常有用——这不起作用有什么原因吗？谢谢! module Foo = { let bar: string = "bar" }; let bar = Foo.bar; /* works *
shell 模块 : < with ansible
我想运行一个命令: - name: install pip shell: "python {"changed": true, "cmd": "python <(curl https://boot

首页

博学

6Ren·AI

商城

Windows下Python使用Pandas模块操作Excel文件的教程