python - 如何实现高斯分布的概率密度函数-6ren

python - 如何实现高斯分布的概率密度函数

转载作者：行者123 更新时间：2023-11-28 21:40:07

26

4

我需要在 Python 中实现一个类，它表示单变量(目前)正态分布。我的想法如下

class Norm():
    def __init__(self, mu=0, sigma_sq=1):
        self.mu = mu
        self.sigma_sq = sigma_sq
        # some initialization if necessary

    def sample(self):
        # generate a sample, where the probability of the value 
        # of the sample being generated is distributed according
        # a normal distribution with a particular mean and variance
        pass

N = Norm()
N.sample()

生成的样本应该按照下面的概率密度函数分布

我知道 scipy.stats 和 Numpy 提供了执行此操作的函数，但我需要了解这些函数是如何实现的。任何帮助将不胜感激，谢谢:)

最佳答案

我最终使用了@sascha 的建议。我看了两个 this维基百科文章和 Numpy 源代码并找到了这个 randomkit.c实现函数 rk_gauss(实现 Box Muller 变换)、rk_double 和 rk_random(实现模拟的 Mersenne Twister 随机数生成器)的文件Box Muller 变换所需的均匀分布随机变量)。

然后我从 here 改编了 Mersenne Twister Generator并实现 Box Muller 变换以模拟高斯分布(有关随机扭曲生成器的更多信息 here)。

这是我最后写的代码:

import numpy as np
from datetime import datetime
import matplotlib.pyplot as plt

class Distribution():
    def __init__(self):
        pass

    def plot(self, number_of_samples=100000):
        # the histogram of the data
        n, bins, patches = plt.hist([self.sample() for i in range(number_of_samples)], 100, normed=1, facecolor='g', alpha=0.75)
        plt.show()

    def sample(self):
        # dummy sample function (to be overridden)
        return 1

class Uniform_distribution(Distribution):
    # Create a length 624 list to store the state of the generator
    MT = [0 for i in xrange(624)]
    index = 0

    # To get last 32 bits
    bitmask_1 = (2 ** 32) - 1

    # To get 32. bit
    bitmask_2 = 2 ** 31

    # To get last 31 bits
    bitmask_3 = (2 ** 31) - 1

    def __init__(self, seed):
        self.initialize_generator(seed)

    def initialize_generator(self, seed):
        "Initialize the generator from a seed"
        global MT
        global bitmask_1
        MT[0] = seed
        for i in xrange(1,624):
            MT[i] = ((1812433253 * MT[i-1]) ^ ((MT[i-1] >> 30) + i)) & bitmask_1

    def generate_numbers(self):
        "Generate an array of 624 untempered numbers"
        global MT
        for i in xrange(624):
            y = (MT[i] & bitmask_2) + (MT[(i + 1 ) % 624] & bitmask_3)
            MT[i] = MT[(i + 397) % 624] ^ (y >> 1)
            if y % 2 != 0:
                MT[i] ^= 2567483615

    def sample(self):
        """
        Extract a tempered pseudorandom number based on the index-th value,
        calling generate_numbers() every 624 numbers
        """
        global index
        global MT
        if index == 0:
            self.generate_numbers()
        y = MT[index]
        y ^= y >> 11
        y ^= (y << 7) & 2636928640
        y ^= (y << 15) & 4022730752
        y ^= y >> 18

        index = (index + 1) % 624
        # divide by 4294967296, which is the largest 32 bit number 
        # to normalize the output value to the range [0,1]
        return y*1.0/4294967296

class Norm(Distribution):
    def __init__(self, mu=0, sigma_sq=1):
        self.mu = mu
        self.sigma_sq = sigma_sq
        self.uniform_distribution_1 = Uniform_distribution(datetime.now().microsecond)
        self.uniform_distribution_2 = Uniform_distribution(datetime.now().microsecond)
        # some initialization if necessary

    def sample(self):
        # generate a sample, where the value of the sample being generated 
        # is distributed according a normal distribution with a particular 
        # mean and variance
        u = self.uniform_distribution_1.sample()
        v = self.uniform_distribution_2.sample()
        return ((self.sigma_sq**0.5)*((-2*np.log(u))**0.5)*np.cos(2*np.pi*v)) + self.mu

这很完美，并且生成了一个很好的高斯分布

Norm().plot(10000)

关于python - 如何实现高斯分布的概率密度函数，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/45991419/

26

4

0

文章推荐： video - 如何使用 javascript 获取 youtube 视频静态图像？

文章推荐： python - 如何正确访问 pysnmp 陷阱中返回的 varBind

文章推荐： design-patterns - 软件设计模式视频？

android - 指定的 Gradle 分布 'https://services.gradle.org/distributions/gradle-4.6-all.zip' 似乎不包含 Gradle 分布
我有两个项目。一个项目正在运行，没有任何问题。它是从 gitlab 下载的。另一个项目是从 github 下载的。 github项目有这个问题。我想使用默认的 gradle 分布。我想知道我做错了什么
Hadoop 分布
我正在通过我学习的大学提供的 VNC 软件(远程访问)使用 IBM bigInsights，但我无法通过该桌面访问 Internet。为了使用互联网上的一些数据样本，我决定安装 Hadoop 在我的笔
带条件列表的 Scala 分布
所以，这非常简单，我有一个包含嵌套列表的列表，如下所示: List( *list1* List(List("n1", "n3"), List("n1", "n4"), List("n3", "n4")
python - 列表和元组之间的连接/分布
我有以下示例。 prefix = ['blue ','brown '] suffix = [('dog','shoes','bike'), ('tree','cat','car')] 我想获得一个如下
MySQL 频率/分布
我创建了一项调查并将其发送出去。该调查要求用户提供电子邮件，然后要求他们从包含 8 个不同选项的下拉菜单中选择要吃哪顿饭。有些人使用同一封电子邮件多次填写调查，但食物选择不同。我有一个如下所示的 M
python - 无边界地 block 分布
我在 Python 中使用 plotly 来创建由某些分类变量着色的美国县的等值线。由于县非常小，因此图像中的边界线占主导地位。我怎样才能摆脱它们(或将它们的宽度设置为零)？到目前为止的代码和输出(
python - python中的 Gamma 分布
我们有qgamma在 R 和 gamm.inv在 excel 中，我无法使用 invgamma 获得相同的结果python中的函数。例如在excel中GAMMA.INV(0.99,35,0.08)=4
docker - Kubernetes Pod 分布
过去几年我经常使用 Docker，但对于 Kubernetes 来说我还是个新手。我从今天开始，与我以前使用 Docker swarm 的方式相比，我正在努力思考 Pod 概念的实用性。假设我有一个
ios - 具有动态标签宽度的堆栈 View 分布
我有一个 UIStackView然而，subViews的第一个 View 是 UILabel它没有相应地调整它的大小。我的代码如下； private let stackView: UIStackVi
r - 用自由度绘制学生的 t 分布
我想绘制自由度为 1、2、5 和 10 的 Student t 分布；所有在一个图中，并为图中的每个分布使用不同的颜色。此外，在 Canvas 的左上角创建一个图例，并增加 df = 1 的曲线线宽。
Python - 根据这些值拟合 GEV 分布
我对 Python 很陌生，我在互联网上浏览过，但找不到任何可以帮助我解决问题的逻辑。我在图中有降水值，现在我需要根据图中的这些值拟合 GEV 分布。每个值等于从 1974 年到 2017 年的一年
python - 对直方图中绘制的给定数据标准化威 bool 分布
我正在尝试复制此图 https://wind-data.ch/tools/weibull.php 我编写的代码是 import matplotlib.pyplot as plt import nump
python - 如何计算文本中词频的最佳 zipf 分布
对于家庭作业，我必须绘制文本的词频并将其与最佳 zipf 分布进行比较。根据对数对数图中的排名绘制文本的词频计数似乎效果很好。但是我在计算最佳 zipf 分布时遇到了麻烦。结果应该如下所示: 我不
r - R中的广义逆 Gamma 分布
Mathematica 具有四参数广义逆 Gamma 分布: http://reference.wolfram.com/mathematica/ref/InverseGammaDistribution
c - Pthreads数组 block 分布
正在用 C 语言开发一个学校项目，使用 Pthreads 将一维数组分解为 tRows 和 tCols 的子矩阵。整个数组的大小为 wRows 和 wCols。假设 wCols = 4、wRows =
c++ - 统一的 int32 分布
有没有办法得到制服int32_t没有警告的分发？我用这个uniform_int_distribution在我的代码中，但我收到警告: 54988961.cpp: In function ‘int ma
performance - postgresql 的负载平衡/分布
在花了相当多的时间试图了解如何在 postgresql 数据库服务器之间实现负载平衡(分配数据库处理负载)之后，我来到这里。我有一个 postgresql 系统，每秒吸引大约 100 笔交易，而且这
python - 创建一个 python 分布
所以标题已经说明了一切。我们正在开发一个开始获得大量依赖项的项目。到目前为止，我们一直在使用 setuptools，但越来越多的依赖项要么不容易安装(例如 wxPython)，要么在某些使用 easy
c++ - boost student_t 分布
我有以下代码: #include #include #include using namespace boost::numeric; using namespace interval_lib;
c# - 通过随机数生成确保均匀(ish)分布
我有一个对象列表，我想以随机顺序连续访问这些对象。我想知道是否有一种方法可以确保随机值并不总是相似。例子。我的列表是队列列表，我试图交错这些值以生成用于测试的真实场景。我并不是特别想要队列 1

首页

博学

6Ren·AI

商城

python - 如何实现高斯分布的概率密度函数