- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
如果我有 2 个特征 x1 和 x2,我知道模式是:
if x1 < x2 then
class1
else
class2
任何机器学习算法都能找到这样的模式吗?那会是什么算法?
我知道我可以创建第三个特征 x3 = x1-x2。那么特征x3就可以很容易地被一些机器学习算法使用。例如,决策树可以使用 x3 和 3 个节点(1 个决策和 2 个叶节点)100% 解决问题。
但是,是否可以在不创建新功能的情况下解决这个问题?如果机器学习算法只能找到这样的模式,这似乎是一个可以 100% 轻松解决的问题。
我尝试了使用不同内核(包括 svg 内核)的 MLP 和 SVM,但结果并不好。作为我尝试的示例,以下是 scikit-learn 代码,其中 SVM 只能获得 0.992 的分数:
import numpy as np
from sklearn.svm import SVC
# Generate 1000 samples with 2 features with random values
X_train = np.random.rand(1000,2)
# Label each sample. If feature "x1" is less than feature "x2" then label as 1, otherwise label is 0.
y_train = X_train[:,0] < X_train[:,1]
y_train = y_train.astype(int) # convert boolean to 0 and 1
svc = SVC(kernel = "rbf", C = 0.9) # tried all kernels and C values from 0.1 to 1.0
svc.fit(X_train, y_train)
print("SVC score: %f" % svc.score(X_train, y_train))
运行代码的输出:
SVC score: 0.992000
这过于简单化了我的问题。真正的问题可能有数百个特征和不同的模式,而不仅仅是 x1 < x2。然而,首先了解如何解决这个简单的模式会有很大帮助。
最佳答案
要理解这一点,您必须了解 sklearn
提供的所有参数的设置,尤其是 C
。它还有助于理解 C
的值如何影响分类器的训练过程。
如果你看看 User Guide for SVC 中的方程,方程有两个主要部分 - 第一部分尝试找到解决问题的一小组权重,第二部分尝试最小化分类错误。
C
是与错误分类相关的惩罚乘数。如果减少 C
,那么您就会减少惩罚(训练准确度较低,但测试的泛化能力会更好),反之亦然。
尝试将C
设置为1e+6
。您会发现您几乎总是获得 100% 的准确率。分类器已学习模式 x1 < x2。但当您查看另一个名为 tol
的参数时,它表明 99.2% 的准确度就足够了。这控制了多少误差对您来说可以忽略不计,默认情况下它设置为1e-3
。如果降低容差,您也可以获得类似的结果。
一般来说,我建议您使用 GridSearchCV
( link ) 来查找 C
等超参数的最佳值,因为这会在内部分割数据集进入训练和验证。这有助于确保您不仅调整超参数以获得良好的训练准确性,而且还确保分类器在实践中表现良好。
关于machine-learning - 任何机器学习算法都可以找到这个模式 : x1 < x2 without generating a new feature (e. g. x1-x2) 首先?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/51449610/
您好,我在最后一步使用了 add 和 offer 来添加我的元素。两者都返回 boolean 值,并且除了 NPE 之外都不会抛出任何异常。 public class ArrayDequeDemo
我正在做一个功能,用户的电子邮件客户端只打开一个预填充的内容 (javascript)。 问题是我在转换特殊字符时遇到问题,因此它们无法正确显示到电子邮件客户端(内容由 url 传递)。 我写了一个函
问题一: 在阅读 JDK 源代码时,我发现该方法 boolean add(E e);在接口(interface)中定义 Collection & Queue & BlockingQueue . 我无法
我想比较 SQL 中的两个 varchar,一个类似于 Cafe ,另一个 Café SQL 中是否有一种方法可以允许这两个值进行比较。例如: SELECT * FROM Venue WHERE Na
我正在研究一种方法来搜索文本中的特定单词并突出显示它们。该代码工作完美,除了我希望它也匹配相似的字母。我的意思是,搜索 fête 应该匹配 fêté、fete、... 有没有一种简单而优雅的方法来做到
所以我有一个非常简单的组件,它加载了一个简单的路由器。我正在使用所有基本的东西,比如 ngFor、ngSwitch、ngIf,我通过 COMMON_DIRECTIVES 注入(inject)它们 我收
我有一个类似 Brazil: Série A 的字符串,我的目标是转换为 Brazil: Serie A。 此外,方法应该转换和其他类似的情况:é -> e, š -> s, ė -> e , ą -
就目前而言,这个问题不适合我们的问答形式。我们希望答案得到事实、引用或专业知识的支持,但这个问题可能会引起辩论、争论、投票或扩展讨论。如果您觉得这个问题可以改进并可能重新打开,visit the he
在我的 app.module.ts @NgModule({ declarations: [ AppComponent ], imports: [ BrowserModule
Sample查询: SELECT e FROM Employee e WHERE SUBSTRING(e.name, 3) = 'Mac' 在这种语法中,说 SELECT e 似乎很直观,即 e 现在
objective-c 中是否有一种简单的方法可以将所有特殊字符(如 ë、à、é、ä)转换为普通字符(如 e en a)? 最佳答案 是的,而且非常简单: NSString *src = @"Conv
我想将 ë 之类的字符转换为普通的 e。我正在寻找关于语言和人们如何输入城市的转换。例如,大多数人在搜索时实际上输入的是 Brasilia,而不是 Brasília。当 Rueters 等新闻机构报道
当我写作时 $("#new_lang").click(function(e) { alert("something"); e.stopPropagation(); }); 这里的 e 是什么,
> 的键是 E 的某些属性,值是具有该属性的 E
我想知道如何将 Java List 转换为 Map。映射中的键是列表元素的某些属性(不同的元素可能具有相同的属性),值是这些列表项的列表(具有相同的属性)。例如。 List --> Map> 。我找到
我试图理解,为什么我们需要 Deque 中的 Offer 和 OfferLast 方法,因为这两种方法都在Deque 的结尾/尾部。它有什么意义? 最佳答案 Queue 接口(interface)是在
这个问题是这个问题的延续 here .如果有人想知道为什么我需要做这样的事情,你可以在那个问题中找到理由。这并不重要,真的。 我需要这样的方法: public virtual Expression>
注意:这个问题与 Enum 无关,所以它不是重复的。Enum 被迫只与自身比较,因为编译器生成类型参数,而不是因为 java 递归类型参数。 我试图找到将类声明为的优势: public class S
注意:这个问题与 Enum 无关,所以它不是重复的。Enum 被迫只与自身比较,因为编译器生成类型参数,而不是因为 java 递归类型参数。 我试图找到将类声明为的优势: public class S
如果我有一个struct example *e,function(&e) 和function(e) 之间有什么区别? 一个例子。 这是第一个代码: #include struct example {
这个问题在这里已经有了答案: C# 7.0 ValueTuples vs Anonymous Types (2 个答案) 关闭去年。 这两个查询有什么区别? var query = from e i
我是一名优秀的程序员,十分优秀!