machine-learning - sklearn SGDClassifier fit() 与partial

machine-learning - sklearn SGDClassifier fit() 与partial_fit()

转载作者：行者123 更新时间：2023-11-30 09:29:20

24

4

我对 SGDClassifier 的 fit() 和 partial_fit() 方法感到困惑。文档中说，“使用随机梯度下降拟合线性模型。”。

我对随机梯度下降的了解是，它需要一个(或整体的一小部分)训练示例来在一次迭代中更新模型参数。梯度下降在每次迭代中使用整个数据集。我想使用逻辑回归训练模型。我想实现正常的梯度下降和随机梯度下降并比较它们所需的时间。如何使用 SGDClassifier 做到这一点？ fit() 方法是否像正常的梯度下降一样工作？

最佳答案

我认为 partial_fit 方法对于更新已经训练过的模型很有用，而 fit 方法将从头开始重新训练模型。

至于手动选择每次权重更新中包含多少数据，我似乎无法在 SGDClassifier documentation 中找到对此的论据。。

关于machine-learning - sklearn SGDClassifier fit() 与partial_fit()，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/40683394/

24

4

0

文章推荐： matlab - 如何使用可变大小的原始图像 block 来训练 SVM？

文章推荐： javascript - Sweetalert2 重定向

文章推荐： javascript - 自定义文件扩展名的 VSCode 导入路径智能感知

文章推荐： machine-learning - 句子相似度算法的探讨

python - SGDClassifier 每次为文本分类提供不同的准确度
我使用 SVM 分类器将文本分类为好文本和乱码。我正在使用 python 的 scikit-learn 并按如下方式进行操作: ''' Created on May 5, 2017 ''' impor
python - sklearn SGDClassifier 模型阈值与模型分数有何关系？
我已经训练了一个模型并确定了一个我想要部署它的“阈值”，但我无法理解阈值与分数的关系。 X = labeled_data[features].reset_index(drop=True) Y = np
python - 计算 SGDClassifier 数据损失函数值的方法？
我使用 SGDClassifier 结合部分拟合方法来使用大量数据进行训练。我想监控何时达到可接受的收敛水平，这意味着我想知道某些数据每 n 次迭代的损失(可能是训练，可能是保留，也许两者都有)。我
python - Scikit SGDClassifier 使用字母而不是单词作为特征
我正在尝试使用 this 之后的 SGDClassifier 对短语进行分类教程我的管道如下所示: p_clf = Pipeline([('vect', CountVectorizer(analyz
python - sklearn sgdclassifier 的多输出预测？
我确实创建了一个与此类似的 scikit 模型。但现在我想提取两个输出。我不知道在训练时如何通过这个。我确实尝试过类似于Keras。 [y,z] 作为列表。但它在 scikit 中不起作用。以前有人尝
python - sklearn SGDClassifier 无法使其确定性地训练或预测
我正在使用 sklearn.linear_model.SGDClassifier 训练一个简单的线性模型。我看到一些结果，在相同的训练集上进行训练有时会产生截然不同的结果。我正在尝试运行一个实验，在其
python - 尝试在二进制分类上训练 SGDClassifier 时出现位置参数错误
我正在处理 Aurelien Geron's Hands-On ML textbook并且在尝试训练 SGDClassifier 时遇到了困难。我正在使用 MNIST 手写数字数据并通过 Anaco
python - Sklearn SGDClassifier 部分拟合
我正在尝试使用 SGD 对大型数据集进行分类。由于数据太大而无法放入内存，我想使用 partial_fit 方法来训练分类器。我选择了适合内存的数据集样本(100,000 行)来测试 fit 与 pa
python - SGDClassifier 类的数量必须大于 1；上了1节课
因此，我已尽一切可能来解决此错误，这也是我巨大的挫败感。 from sklearn.linear_model import SGDClassifier train_labels_9 = [(label
python - scikit-learn 将额外数据添加到 SGDClassifier
我正在尝试使用 scikit-learn 进行文本分类。我的文本无法很好地分类。我认为我可以通过添加可以以整数数组的形式推导的数据来改进预测。例如，示例 1 将带有 [3, 1, 5, 2]，示例
python - SGDClassifier 在 MNIST 上的使用
我正在使用使用 scikit_Learn 进行机器学习实践”(O'Reilly)进行自学，目前正在使用具有不同分类器的 MNIST 数据。第 94 页的文本表示，SGDClassifier 能够执行
machine-learning - 向 SGDClassifier 添加新类？
我目前正在使用 partial_fit 和 SGDClassifier拟合模型来预测图像上的主题标签。我遇到的问题是 SGDClassifier 需要预先指定类。这可以离线拟合模型，但我想在观察新主
python - Scikit Learn SGDClassifier 预测问题
我可能无法在这里找到我需要的帮助，但我希望互联网上的聪明编码者可以帮助我。我正在尝试使用 Python 的 Sci-Kit learn SGDClassifier 对物理事件进行分类。这些物理事件创建
python - MNIST 和 SGDClassifier 分类器
我正在尝试使用在线( out-of-core) 学习算法来解决 MNIST 问题，使用 SGDClassifier但似乎准确率并不总是在增加。这种情况我该怎么办？以某种方式保存最准确的分类器？SGD
python - sklearn.linear_model.SGDClassifier 中损失函数的精确定义
我知道我可能会将损失函数更改为以下之一: loss : str, 'hinge' or 'log' or 'modified_huber' The loss function to be used.
python - SGDClassifier 中的 sample_weight 是如何工作的？
我想在训练 SGDClassifier 时使用重要性采样。我已经看到 fit 和 partial_fit 方法中有一个 sample_weight 参数，但我不确定这个参数是如何工作的。假设我有 1
python - 带有 predict_proba 的 SGDClassifier
我正在使用 sklearn 库来训练和测试我的数据。 targetDataCsv = pd.read_csv("target.csv","rt")) testNormalizedCsv = csv.
python - SciKit Learn - SGDClassifier 准确性不佳
我正在尝试使用 SGDClassifier 对一些数据进行建模，但由于某种原因，我的准确性很差。我对此很陌生，所以我不太明白为什么。这是我的代码: from sklearn.preprocessin
python - scikit-learn SGDClassifier 热启动被忽略
我正在尝试使用 scikit-learn 版本 0.15.1 中的 SGDClassifier。除了迭代次数之外，似乎没有任何方法可以设置收敛标准。因此，我想通过在每次迭代时检查错误来手动执行此操作，
python - Scikit-learn 中 SGDClassifier 中最佳学习率的公式
我找不到 SGDClassifier in Scikit-learn 的学习率公式当 learning_rate='optimal' 时，在同一函数的原始 C++ 源代码中https://leon.b

首页

博学

6Ren·AI

商城

machine-learning - sklearn SGDClassifier fit() 与partial_fit()