python - 使用 Scipy 与 Matlab 拟合对数正态分布-6ren

python - 使用 Scipy 与 Matlab 拟合对数正态分布

转载作者：太空宇宙更新时间：2023-11-03 13:48:02

24

4

我正在尝试使用 Scipy 拟合对数正态分布。我之前已经使用 Matlab 完成了它，但由于需要将应用程序扩展到统计分析之外，我正在尝试在 Scipy 中重现拟合值。

下面是我用来拟合数据的 Matlab 代码:

% Read input data (one value per line)
x = [];
fid = fopen(file_path, 'r'); % reading is default action for fopen
disp('Reading network degree data...');
if fid == -1
    disp('[ERROR] Unable to open data file.')
else
    while ~feof(fid)
        [x] = [x fscanf(fid, '%f', [1])];

    end
    c = fclose(fid);
    if c == 0
         disp('File closed successfully.');
    else
        disp('[ERROR] There was a problem with closing the file.');
    end
end

[f,xx] = ecdf(x);
y = 1-f;

parmhat  = lognfit(x); % MLE estimate
mu = parmhat(1);
sigma = parmhat(2);

这是拟合图:

enter image description here

现在这是我的 Python 代码，目的是实现相同的目的:

import math
from scipy import stats
from statsmodels.distributions.empirical_distribution import ECDF 

# The same input is read as a list in Python
ecdf_func = ECDF(degrees)
x = ecdf_func.x
ccdf = 1-ecdf_func.y

# Fit data
shape, loc, scale = stats.lognorm.fit(degrees, floc=0)

# Parameters
sigma = shape # standard deviation
mu = math.log(scale) # meanlog of the distribution

fit_ccdf = stats.lognorm.sf(x, [sigma], floc=1, scale=scale)

这是使用 Python 代码的拟合。

enter image description here

如您所见，两组代码都能产生良好的拟合效果，至少在视觉上是这样。

问题在于估计的参数 mu 和 sigma 存在巨大差异。

来自 Matlab:mu = 1.62 sigma = 1.29。来自 Python:mu = 2.78 sigma = 1.74。

为什么会有这样的差异？

注意:我已经仔细检查了两组拟合的数据完全相同。相同数量的点，相同的分布。

非常感谢您的帮助!提前致谢。

其他信息:

import scipy
import numpy
import statsmodels

scipy.__version__
'0.9.0'

numpy.__version__
'1.6.1'

statsmodels.__version__
'0.5.0.dev-1bbd4ca'

Matlab 版本为 R2011b。

版本:

如以下答案所示，问题出在 Scipy 0.9 上。我能够使用 Scipy 11.0 从 Matlab 重现 mu 和 sigma 结果。

更新 Scipy 的一种简单方法是:

pip install --upgrade Scipy

如果你没有 pip(你应该!):

sudo apt-get install pip

最佳答案

scipy 0.9.0 中的fit 方法有一个错误，在以后的scipy 版本中已经修复。

下面脚本的输出应该是:

Explicit formula:   mu = 4.99203450, sig = 0.81691086
Fit log(x) to norm: mu = 4.99203450, sig = 0.81691086
Fit x to lognorm:   mu = 4.99203468, sig = 0.81691081

但是对于 scipy 0.9.0，它是

Explicit formula:   mu = 4.99203450, sig = 0.81691086
Fit log(x) to norm: mu = 4.99203450, sig = 0.81691086
Fit x to lognorm:   mu = 4.23197270, sig = 1.11581240

以下测试脚本展示了三种获得相同结果的方法:

import numpy as np
from scipy import stats


def lognfit(x, ddof=0):
    x = np.asarray(x)
    logx = np.log(x)
    mu = logx.mean()
    sig = logx.std(ddof=ddof)
    return mu, sig


# A simple data set for easy reproducibility
x = np.array([50., 50, 100, 200, 200, 300, 500])

# Explicit formula
my_mu, my_sig = lognfit(x)

# Fit a normal distribution to log(x)
norm_mu, norm_sig = stats.norm.fit(np.log(x))

# Fit the lognormal distribution
lognorm_sig, _, lognorm_expmu = stats.lognorm.fit(x, floc=0)

print "Explicit formula:   mu = %10.8f, sig = %10.8f" % (my_mu, my_sig)
print "Fit log(x) to norm: mu = %10.8f, sig = %10.8f" % (norm_mu, norm_sig)
print "Fit x to lognorm:   mu = %10.8f, sig = %10.8f" % (np.log(lognorm_expmu), lognorm_sig)

在 std 中使用选项 ddof=1。开发者使用无偏方差估计的计算:

In [104]: x
Out[104]: array([  50.,   50.,  100.,  200.,  200.,  300.,  500.])

In [105]: lognfit(x, ddof=1)
Out[105]: (4.9920345004312647, 0.88236457185021866)

matlab的lognfit documentation中有注释也就是说，当不使用审查时，lognfit 使用方差的无偏估计量的平方根来计算 sigma。这对应于在上面的代码中使用 ddof=1。

关于python - 使用 Scipy 与 Matlab 拟合对数正态分布，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/15630647/

24

4

0

文章推荐： c - 不属于的随机字节，SSL_read

matlab - Matlab 中的示例脚本文件与 Matlab 中的标准脚本文件不同吗？
在 Matlab 中，您可以选择创建新的“示例”脚本文件以及脚本、函数、类等。创建它们时，它们会获得一个脚本图标。它们与其他标准脚本文件的处理方式有何不同？是否有关于这些示例脚本类型的预期用途的文
matlab - matlab 脚本中是否使用了某些 matlab 例程？
我正在运行一个不是我自己编写的大 m 文件，它依赖于某些子函数。我想知道是否在所有嵌套函数的任何地方都使用了特定函数(在我的例子中是函数 eig.m(计算特征值))。有没有快速的方法来做到这一点？亲
matlab - 如何查看 Matlab 函数背后的 Matlab 代码
Matlab中有一个函数叫 copulafit .我怎样才能看到这个函数背后的代码？许多 Python 的 numpy 和 scipy 函数在 Github 上很容易开源，但由于某种原因我在 Gith
matlab - Matlab 编码器的 OOP Matlab 继承问题(Simulink MATLAB 功能 block )
我定义了一个抽象基类measurementHandler < handle它定义了所有继承类的接口(interface)。这个类的两个子类是a < measurementHandler和 b < me
matlab - 如何遍历 matlab 中矩阵的列并将它们分别添加到 matlab 中求和矩阵的特定列？
假设有一个矩阵 A = 1 3 2 4 4 2 5 8 6 1 4 9 例如，我有一个 Vector 包含该矩阵每一列的“类”
matlab - 在不修改 Matlab 脚本的情况下禁用 Matlab 焦点窃取
我有一个在后台运行的 Matlab 脚本。随着计算的进行，它会不断弹出进度栏窗口。这很烦人。问题是我没有自己写 Matlab 脚本，这是一段很长很复杂的代码，我不想搞砸。那么如何在不修改 Matla
matlab - 从 matlab 中检测 matlab 进程
有没有办法从一个 matlab 程序中检测计算机上正在运行多少个 matlab 进程？我想要恰好有 n 个 matlab 进程在运行。如果我的数量太少，我想创建它们，如果数量太多，我想杀死一些。您当
matlab - 使用比 Matlab 脚本更多的内存部署的 Matlab 应用程序
我正在测试我们在 Matlab 中开发的一个独立应用程序，当时我注意到它的内存使用量(根据 Windows 任务管理器)达到了 16gb 以上的数倍峰值。我决定在编译版本后面的脚本上使用 profil
matlab - Matlab 命令窗口中的俄文字母
我面临着一个相当棘手的问题。在 Matlab 中，命令 S = char(1044) 将俄语字母 д 放入变量 S。但是 disp(S) 返回空白符号，尽管内容实际上是正确的: >> S = char
matlab - MATLAB 是否在常量空间中执行基本数组操作？
我在这行 MATLAB 代码中遇到内存不足错误: result = (A(1:xmax,1:ymax,1:zmax) .* B(2:xmax+1,2:ymax+1,2:zmax+1) +
matlab - MATLAB 是否有类似集合的数据类型？
我正在寻找一种在 MATLAB 中比较有限顺序数据与非确定性顺序的方法。基本上，我想要的是一个数组，但不对包含的元素强加顺序。如果我有对象 a = [x y z]; 和 b = [x z y]; 我希
matlab - 根据序列大小替换重复值 - Matlab
我有一个由 1 和 0 组成的二维矩阵。 mat = [0 0 0 0 1 1 1 0 0 1 1 1 1 1 0 0 1 0 0 0 1 0 1 1 0 0 1]; 我需
matlab - Matlab 中点簇的回归线
我可以在 Matlab 中用一组 x,y 点绘制回归线。但是，如果我有一组点(如下图)，假设我有四组点，我想为它们绘制四条回归线……我该怎么做？所有的点都保存在 x,y 中。没有办法将它们分开并将它们
matlab - MATLAB 曲面图中的间隙
我正在尝试使用以下代码在 MATLAB 中绘制圆锥体。但是，当 MATLAB 生成绘图时，曲面中有一个间隙，如下图所示。谁能建议关闭它的方法？ clearvars; close all; clc; [
matlab - MATLAB 中的映射有多少字节？
我有一个 map称为 res_Map，包含一组不同大小的数组。我想找到用于存储 res_Map 的总内存。正如您在下面看到的，看起来 res_Map 几乎不占用内存，而 res_Map 中的各个元素
matlab - MATLAB 中的向量到矩阵语法
有没有办法在 MATLAB 中组合 2 个向量，这样: mat = zeros(length(C),length(S)); for j=1:length(C) mat(j,:)=C(j)*S;
matlab - MATLAB 中的极分解
已结束。此问题不符合 Stack Overflow guidelines 。它目前不接受答案。我们不允许提问寻求书籍、工具、软件库等的推荐。您可以编辑问题，以便用事实和引用来回答它。关闭 5 年前
matlab - MatLab:胆碱必须是正定的
我正在尝试将MatLab中的t copula适配到我的数据，并且我的功能是: u = ksdensity(range_1, range_1,'function','cdf'); v = ksdens
matlab - Matlab 中的多尺度形态学图像简化
大家好，我目前正在尝试使用论文“多尺度形态学图像简化”中的 SMMT 运算符 Dorini .由于没有订阅无法访问该页面，因此我将相关详细信息发布在这里: 请注意，我将相关文章的部分内容作为图片发布。
matlab - MATLAB:使用具有相同名称的不同版本的函数
我在MATLAB中编写代码，需要使用一个名为modwt的函数，该函数同时存在于两个我同时使用的工具箱（Wavelet和WMTSA）中。问题在于，一个版本仅返回一个输出，而另一个版本则返回三个输出。我应

首页

博学

6Ren·AI

商城

python - 使用 Scipy 与 Matlab 拟合对数正态分布