Python常用数据分析模块原理解析-6ren

Python常用数据分析模块原理解析

转载作者：qq735679552 更新时间：2022-09-29 22:32:09

24

4

CFSDN坚持开源创造价值，我们致力于搭建一个资源共享平台，让每一个IT人在这里找到属于你的精彩世界.

这篇CFSDN的博客文章Python常用数据分析模块原理解析由作者收集整理，如果你对这篇文章有兴趣，记得点赞哟.

前言。

python是一门优秀的编程语言，而是python成为数据分析软件的是因为python强大的扩展模块。也就是这些python的扩展包让python可以做数据分析，主要包括numpy，scipy，pandas，matplotlib，scikit-learn等等诸多强大的模块，在结合上ipython交互工具，以及python强大的爬虫数据获取能力，字符串处理能力，让python成为完整的数据分析工具.

Python常用数据分析模块原理解析

numpy 。

官网：https://www.scipy.org/ 。

NumPy（Numerical Python的简称）是高性能科学计算和数据分析的基础包。NumPy最重要的一个特点就是其N维数组对象（即ndarray），该对象是一个快速而灵活的大数据集容器。可以利用这种数组对整块数据执行一些数学运算，比python自带的数组以及元组效率更高，其语法跟变量元素之间的运算一样，无需进行循环操作.

在使用python进行数据分析的过程中，我们大部分时候是不会直接使用numpy包，而是其他包要用到numpy。可以说numpy是整个python数据分析工作的基石.

举个简单的案例，我们要计算100000个随机数的值，如果传统编程需要写循环，用了2.2s，而使用numpy数据结构，则可以进行向量化操作，无需循环，只需要28.2ms节约大量时间.

 
    ? 
   
 
     
       
       
         In [ 
         1 
         ]:  
         import 
         numpy 
        
 
         In [ 
         2 
         ]: my_arr  
         = 
         np.arange( 
         1000000 
         ) 
        
 
         In [ 
         3 
         ]: my_list  
         = 
         list 
         ( 
         range 
         ( 
         1000000 
         )) 
        
 
         In [ 
         4 
         ]:  
         % 
         time  
         for 
         _  
         in 
         range 
         ( 
         10 
         ): my_arr2  
         = 
         my_arr  
         * 
         2 
        
 
         Wall time:  
         28.2 
         ms 
        
 
         In [ 
         5 
         ]:  
         % 
         time  
         for 
         _  
         in 
         range 
         ( 
         10 
         ): my_list2  
         = 
         [x  
         * 
         2 
         for 
         x  
         in 
         my_list] 
        
 
         Wall time:  
         2.2 
         s 
        
 
     
 
   

pandas 。

官网：https://pandas.pydata.org/ 。

Python Data Analysis Library，可根据需要帮助组织各种参数的数据。pandas基于numpy底层数据结构。让python成为类似Excel，R等统计学软件，主要就是pandas的功劳。pandas在python中实现了各种数据的计算，分组计算，添加删除，排序，筛选，抽样等都能工作。使Pandas成为数据科学家中最受欢迎的库.

pandas主要包含两种数据结构：Series与DataFrame。Series是一种类似于以为数组的对象，它由一组数据以及与之相关的数据标签组成，仅有一组数据即可产生最简单的Series。Series类似于R中的向量，属于以为数据。Series可以构成二维的DataFrame。行为记录值，列为观测值。如果熟悉R中的数据框DataFrame，在使用pandas则会轻松上手，因为作者自己说pandas的DataFrame就是模仿R的数据框.

scipy 。

官网：https://www.scipy.org/ 。

scipy是一个用于数学、科学、工程领域的常用软件包，可以处理插值、积分、优化、图像处理、常微分方程数值解的求解、信号处理等问题。它用于有效计算Numpy矩阵，使Numpy和Scipy协同工作，高效解决问题。 Scipy是由针对特定任务的子模块组成:

Python常用数据分析模块原理解析

matplotlib 。

官网：https://matplotlib.org/ 。

matplotlib是python中优秀的数据可视化的包，根据命名就可以看到，它其实是一个matlib的plot库，也就是利用python将matlib的绘图功能实现了一遍。如果你熟悉matlib绘图，那么将直接上手。matplotlib是Python编程语言及其数值数学扩展包 NumPy的可视化操作界面。它为利用通用的图形用户界面工具包，如Tkinter, wxPython, Qt或GTK+向应用程序嵌入式绘图提供了应用程序接口（API）.

plotnine 。

官网：https://plotnine.readthedocs.io/en/stable/ 。

如果你不熟悉matlib，而是从R转到python，可能不太喜欢matplotlib的绘图模式和风格，觉得不如R绘图方便。而且R还有ggplot2包。那么plotnine则是将ggplot2移植到python上，在python上完全重现ggplot2的功能。如果你熟悉ggplot2的语法，直接上手。不过，我倒是觉得这个工作意义不大，这属于重新发明轮子，后面如果ggplot2在更新了，二者之间还是会有一些差别，用户会有些困扰。当然，这样的问题仁者见仁，愚者见愚。聊胜于无，如果想在 python环境中完成全部工作，有了这个包还是非常不错的.

Python常用数据分析模块原理解析

scikit-learn 。

官网：https://scikit-learn.org/stable/ 。

有很多人不是天天喜欢三句话不离大数据，机器学习，人工智能吗。那么scikit-learn则是完成python大数据机器学习的包。scikit-Learn是python数据分析中非常重要的一个模块，它是一个基于NumPy和SciPy构建的开源机器学习工具包。它具有常用的ML算法，可用于预处理，分类，回归以及聚类。算法包括[支持向量机]( support vector machines，ridge回归，网格搜索算法(Grid Search algorithm) ，k均值聚类等等。另外还有样本数据集。API易学易用。在几乎所有平台上的良好性能，它在学术和商业用途中都很受欢迎.

Python常用数据分析模块原理解析

其他:

除了以上包之外，python还有很多很多其他有关数据分析的包，不胜枚举，比如图片识别的opencv，google机器学习开源库tensorflow，PyTorch等等，一个崭新的世界等待你去发现。但是前提是前面基础这些包熟悉了，以及有最核心的计算机以及统计学基础，否则就是无水之源，无木之本，你所谓的人工智能，只能是人工智障.

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持我.

原文链接：https://www.cnblogs.com/zwhy8/p/13329881.html 。

最后此篇关于Python常用数据分析模块原理解析的文章就讲到这里了,如果你想了解更多关于Python常用数据分析模块原理解析的内容请搜索CFSDN的文章或继续浏览相关文章，希望大家以后支持我的博客！。

24

4

0

文章推荐：基于循环神经网络(RNN)实现影评情感分类

文章推荐： spring boot 集成shiro的配置方法

文章推荐： java语言中封装类代码示例

文章推荐：基于循环神经网络(RNN)的古诗生成器

找不到 Python 模块 "cx_Oracle"模块
我最近在我的机器上安装了 cx_Oracle 模块，以便连接到远程 Oracle 数据库服务器。 (我身边没有 Oracle 客户端)。 Python:版本 2.7 x86 Oracle:版本 11.
python - Timeit 模块 - 将参数传递给 python timeit 模块
我想从 python timeit 模块检查打印以下内容需要多少时间，如何打印， import timeit x = [x for x in range(10000)] timeit.timeit("
javascript - 我该如何修复 --> 文件是 CommonJS 模块；它可以转换为 ES6 模块
我盯着 vs 代码编辑器上的 java 脚本编码，当我尝试将外部模块包含到我的项目中时，代码编辑器提出了这样的建议 -->(文件是 CommonJS 模块；它可能会转换为 ES6 模块。 )..有什么
javascript - 如何在 ES6 模块 Node 应用程序中包含 commonjs 模块？
我有一个 Node 应用程序，我想在标准 ES6 模块格式中使用(即 "type": "module" in the package.json ，并始终使用 import 和 export)而不转译为
css - BlueprintJS 未加载其图标 CSS 模块，但能够加载核心 CSS 模块
我正在学习将 BlueprintJS 合并到我的 React 网络应用程序中，并且在加载某些 CSS 模块时遇到了很多麻烦。我已经安装了 npm install @blueprintjs/core和
javascript - 将 RequireJS 模块 (AMD) 重构为 Webpack 模块 (CommonJS)
我需要重构一堆具有这样的调用的文件 define(['module1','module2','module3' etc...], function(a, b, c etc...) { //bun
javascript - 是否使用 : var app = angular. 模块...或简单地使用 : angular. 模块(
我是 Angular 的新手，正在学习各种教程(Codecademy、thinkster.io 等)，并且已经看到了声明应用程序容器的两种方法。首先: var app = angular.module
unit-testing - 在 OCaml 中使用 OUnit 模块 - 未绑定(bind)模块 OUnit 错误
我正在尝试将 OUnit 与 OCaml 一起使用。单元代码源码(unit.ml)如下: open OUnit let empty_list = [] let list_a = [1;2;3] le
javascript - "Argument ' 模块 ' is not a function, got Object"- 使用 webpack 导入 Angular 模块
我在 Angular 1.x 应用程序中使用 webpack 和 ES6 模块。在我设置的 webpack.config 中: resolve: { alias: { 'angular':
node-modules - 内部/模块/cjs/loader.js :750 return process. dlopen(模块，path.toNamespacedPath(文件名))；
internal/modules/cjs/loader.js:750 return process.dlopen(module, path.toNamespacedPath(filename));
JavaScript 模块
在本教程中，您将借助示例了解 JavaScript 中的模块。随着我们的程序变得越来越大，它可能包含许多行代码。您可以使用模块根据功能将代码分隔在单独的文件中，而不是将所有内容都放在一个文件
JavaScript 模块
我想知道是否可以将此代码更改为仅调用 MyModule.RED 而不是 MyModule.COLORS.RED。我尝试将 mod 设置为变量来存储颜色，但似乎不起作用。难道是我方法不对？ (funct
JavaScript 模块
我有以下代码。它是一个 JavaScript 模块。 (function() { // Object var Cahootsy; Cahootsy = { hello:
angular - 模块 : when and why?
关闭。这个问题是 opinion-based 。它目前不接受答案。想要改进这个问题？更新问题，以便 editing this post 可以用事实和引文来回答它。关闭 2 年前。 Improve
Lua极简入门指南（六）：模块
从用户的角度来看，一个模块能够通过 require 加载并返回一个 table，模块导出的接口都被定义在此 table 中（此 table 被作为一个 namespace）。所有的标准库都是模块。标
ruby 模块
Ruby的模块非常类似类,除了: 模块不可以有实体模块不可以有子类模块由module...end定义. 实际上...模块的'模块类'是'类的类'这个类的父类.搞懂了吗?不懂?让我们继续看
Perl GetOptions 模块
我有一个脚本，它从 CLI 获取 3 个输入变量并将其分别插入到 3 个变量: GetOptions("old_path=s" => \$old_path, "var=s" =
Python 模块，引用同一包中的其他模块？
我有一个简单的 python 包，其目录结构如下: wibble | |-----foo | |----ping.py | |-----bar | |----pong.py 简单的
ocaml - 无法解构仿函数(模块)
这种语法会非常有用——这不起作用有什么原因吗？谢谢! module Foo = { let bar: string = "bar" }; let bar = Foo.bar; /* works *
shell 模块 : < with ansible
我想运行一个命令: - name: install pip shell: "python {"changed": true, "cmd": "python <(curl https://boot

首页

博学

6Ren·AI

商城

Python常用数据分析模块原理解析