r - 使用 knn 分类器进行边界决策-6ren

r - 使用 knn 分类器进行边界决策

转载作者：行者123 更新时间：2023-12-04 11:24:18

25

4

我想找到边界决策函数以便对我的数据进行分类。这是其中的一个例子。

 "Distance","Dihedral","Categ"
    4.083,82.267,C
    4.132,87.073,C
    4.713,-80.999,C
    3.427,-48.144,NC
    3.663,96.994,C
    3.99,71.919,C
    3.484,78.684,C

到目前为止，我已经有了 knn 模型，但我想绘制非线性决策边界。在我搜索过的示例中，有一些变量我不知道在哪里使用它们或它们是什么意思。我说的是我在《统计学习的要素》一书中找到的这个例子

library(ElemStatLearn)
require(class)
x <- mixture.example$x
g <- mixture.example$y
xnew <- mixture.example$xnew
mod15 <- knn(x, xnew, g, k=15, prob=TRUE)
prob <- attr(mod15, "prob")
prob <- ifelse(mod15=="1", prob, 1-prob)
px1 <- mixture.example$px1
px2 <- mixture.example$px2
prob15 <- matrix(prob, length(px1), length(px2))
par(mar=rep(2,4))
contour(px1, px2, prob15, levels=0.5, labels="", xlab="", ylab="", main=
        "15-nearest neighbour", axes=FALSE)
points(x, col=ifelse(g==1, "coral", "cornflowerblue"))
gd <- expand.grid(x=px1, y=px2)
points(gd, pch=".", cex=1.2, col=ifelse(prob15>0.5, "coral", "cornflowerblue"))
box()

px1 和 px2 到底是什么？我的特定情况是否需要类似的变量？

非常感谢您的帮助!

最佳答案

我已经修改并注释了这个例子，以清楚地说明会发生什么。

该示例构建了一个测试集，它只是一个扩展的网格，可以转换整个测试集。因此 px1 是一个向量，描述了测试数据网格的 x 分量，px2 类似，但对于 y。那么xnew就是expand.grid()的结果。

尝试下面的代码，这里应该相当清楚。我还修改了 k 值，并提供了一种使用您选择的间隔构造 xnew 的简单方法。

library(ElemStatLearn)
require(class)

# Use the training data from mixture.example
x <- mixture.example$x
g <- mixture.example$y

# Construct a test grid using the extent of the training data
xx_range <- round(range(x[, 1]), 1)
xy_range <- round(range(x[, 2]), 1)

nnn <- 0.1
px1 <- seq(xx_range[1], xx_range[2], by = nnn) # vector with x extent
px2 <- seq(xy_range[1], xy_range[2], by = nnn) # vector with y extent
xnew <- as.matrix(expand.grid(px1, px2))       # matrix of new values

# Train a model
k <- 10
mod15 <- knn(x, xnew, g, k=k, prob=TRUE)
prob <- attr(mod15, "prob")
prob <- ifelse(mod15=="1", prob, 1-prob)
prob15 <- matrix(prob, length(px1), length(px2))

# Plot the results
par(mar=rep(2,4))
contour(px1, px2, prob15, levels=0.5, labels="", xlab="", ylab="", main=
          sprintf("%d-nearest neighbour", k), axes=FALSE)
points(x, col=ifelse(g==1, "coral", "cornflowerblue"))
points(xnew, pch=".", cex=1.2, col=ifelse(prob15>0.5, "coral", "cornflowerblue"))
box()

关于r - 使用 knn 分类器进行边界决策，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/40855449/

25

4

0

文章推荐： r - 如何找到加权相关的 p 值？

文章推荐： vscode-remote - 我如何解决 "Failed to parse remote port from server"

文章推荐： python - 如何将 python 的 "import this"作为字符串返回？

r - 为什么 R 在我学习期间传递命令 (knn.pred=knn(train.X,test.X,train.Y,k=1)) 时抛出错误(找不到函数 "knn")？
library(ISLR) standardized.X=scale(Caravan [,-86]) test =1:1000 train.X=standardized.X[-test ,] test
python - 多标签分类 ML-kNN 与 KNN
这可能是一个愚蠢的问题，但我只是想知道在 scikit.ml 中实现的 ML-KNN 与 scikit-learn 的 KNeighborsClassifier 之间的区别是什么。根据sklearn'
machine-learning - KNN 中的 knn.score 和准确率指标有什么区别 - SKlearn
我担心我的预测与测试的准确性，这完全有意义。 X_train , X_test, y_train ,y_test =train_test_split(iris_dataset['data'], iri
machine-learning - tensorflow KNN : How can we assign the K parameter for defining number of neighbors in KNN?
我已经开始在 python tensorflow 库上使用 K-Nearest-Neighbors 方法开发一个机器学习项目。我没有使用tensorflow工具的经验，所以我在github上找到了一些
算法金|再见！！！KNN
大侠幸会，在下全网同名「算法金」 0 基础转 AI 上岸，多个算法赛 Top 「日更万日，让更多人享受智能乐趣」 KNN算法的工作原理简单直观，易于理解和实现，这使得它在各种应用场景
R knn 大型数据集
我试图在 R 中使用 knn(使用了几个包( knnflex ， class ))来预测基于 8 个变量的违约概率。数据集大约有 100k 行 8 列，但我的机器似乎很难处理 10k 行的样本。在数据
r - knn 聚类预测
我有一个 60.000 obs/40 变量数据集，我在其中使用了 Clara，主要是由于内存限制。 library(cluster) library(dplyr) mutate(kddne
r - knn 函数出错
我尝试运行这条线: knn(mydades.training[,-7],mydades.test[,-7],mydades.training[,7],k=5) 但我总是收到这个错误: Error in
python - kNN - 如何根据计算的距离在训练矩阵中定位最近的邻居
我正在尝试使用 python 实现 k-近邻算法。我最终得到了以下代码。但是，我正在努力寻找最近邻居项目的索引。以下函数将返回距离矩阵。但是，我需要在features_train(算法的输入矩阵)中获
pandas - Knn 对距离上的特定特征赋予更多权重
我正在使用Kobe Bryant Dataset 。我希望用 KnnRegressor 预测 shot_made_flag。我使用game_date来提取year和month特征: # covert
python - kNN 中一个点的最远点
在 kNN classifier 的文档中，有一个方法kneighbors ，返回 k 个最近邻居。我感兴趣的是如何优雅地返回此类分类器中的 k 个最远邻居？最佳答案不，没有这样的能力。您需要记
optimization - KNN 中需要优化哪些参数？
我想优化 KNN。关于SVM、RF和XGboost的内容有很多；但对于 KNN 来说很少。据我所知，邻居的数量是一个需要调整的参数。但是还有哪些参数需要测试呢？有什么好的文章吗？谢谢最佳答案
python - KNN 查询数据维度必须与训练数据维度匹配
我正在尝试使用具有两列的数据集进行词袋问题 - 摘要和解决方案。我正在使用 KNN。训练数据集有 91 列，测试数据集有 15 列。为了生成向量，我使用以下代码。 vectorizer = Coun
statistics - KNN 中的软投票是什么？
我了解 k 最近邻 (KNN) 的工作原理，但我不熟悉“软投票”一词。与 KNN 相关的软投票是什么？它与标准 KNN 投票相比如何工作？比较两种投票方案的简单示例会很有用，并且指向 Matlab
python - 带有提示数据集的 KNN
我正在尝试将 KNN 应用到 tips 数据集并将对象映射如下: f.Male=df.Gender.map({'Female':0,'Male':1}) df.Smokes = df.Smoker.
python - knn.score参数说明
在下面的代码(最后一行)中，根据文档使用了 X_test 和 y_test: Returns the mean accuracy on the given test data and label 问题
python - KNN - 我如何加速？
我有约 65 个特征、450k 个观察值和不平衡的分类响应变量 Y(约 5% 真实，2 个状态)的 df。这已通过 train_test_split 分为 {Xtrain, ytrain} (10%)
algorithm - KNN 算法中需要归一化
为什么在 KNN 中需要规范化？我知道这个过程标准化了所有特征对结果的影响，但是在标准化之前到特定点 V 的“K”最近点将与到该特定点的“K”最近点完全相同归一化后的 V。那么归一化对欧氏距离有何影响
algorithm - kNN 是统计分类器吗？
我目前正在为我的人工智能考试做一个机器学习项目。目标是使用 WEKA 正确选择两种分类算法进行比较，请记住，这两种算法必须有足够的不同才能进行比较。此外，算法必须同时处理标称数据和数字数据(我想这是进
algorithm - 决策树与朴素贝叶斯与 KNN
进行数据挖掘时，什么时候应该选择其中一种算法而不是另一种？有具体原因吗？另外，其中哪一个是最有效的？我将给出一个表格作为示例。最佳答案一种选择方法是尝试所有这些并选择最好的。如果我要尝试构建数

首页

博学

6Ren·AI

商城

r - 使用 knn 分类器进行边界决策