algorithm - AlphaGo self 提升-6ren

algorithm - AlphaGo self 提升

转载作者：塔克拉玛干更新时间：2023-11-03 05:19:42

25

4

我读过几篇关于 AlphaGo 的新闻文章，它们都提到 AlphaGo 从先与人类对弈，然后与自己对弈，变得更好。我很好奇的一件事是，AlphaGo 是如何改进自己的？它会修改代码中的变量吗？或者它会完全改变它自己编写的代码吗？还是创作者添加的？它实际上是如何学习的？笼统的答案很好，因为它只是我的常识。

也许我误解了整个概念，新闻文章往往会给出广泛的、有时是错误的理解。一些清晰度或指向有用信息的链接会很好。

最佳答案

AlphaGo 使用机器学习。

在机器学习中，您有一个函数(比如 ax +b)可以给您一个结果，您可以调整该函数的参数(a 和 b ) 以便结果匹配越来越多的示例。就 AlphaGo 而言，他们有 2 个函数，一个用于选择下一步，另一个用于说明谁获胜，两者都非常复杂，有数千个参数。

当他们在 AlphaGo 的两个实例之间进行对弈时，他们会记录结果并将其作为示例来训练函数，以便下一个版本的下棋效果更好。

如果您想了解更多信息，网上有很多关于机器学习如何工作的很棒的教程。

关于algorithm - AlphaGo self 提升，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/36774241/

25

4

0

文章推荐： c# - 如何以编程方式确定我的处理器类型？

JavaScript 提升
在本教程中，您将通过示例学习 JavaScript。 JavaScript 中的提升是一种在声明之前可以使用函数或变量的行为。例如， // using test before declarin
JavaScript 提升
我正在学习javascript提升功能，发现下面的代码真的很困惑: var a = 1; function b() { a = 10; return; function a()
Javascript 提升
作为一个JS学习者，我发现了一件很有趣的事情，考虑下面的代码。 this.init = function (e) { var container = e.container;
Scala Quasiquote 提升
Quasiquotes 的 Scala 文档在解释 Lifting 时提到了这一点: One can also combine lifting and unquote splicing: scala
提升 session 管理
我是新来的。到目前为止，我一直在使用 MVC 模型并使用基本的 session 管理模型，即在 session 中存储一个 token 并检查每个请求。我正在尝试对lift做同样的事情，但我的 se
elasticsearch - 根据字段值添加查询时间权重/提升
我当前使用的是Elasticsearch 2.4版，希望根据查询时间的增加或加权，根据我称为“类型”的字段对结果集进行微调。例如如果字段“类型”的值为“船”，则将权重或增强值增加4 如果字段“类型
haskell - 提升、返回和变压器类型构造函数
一年多以来，我一直在大量使用 lift、return 以及 EitherT、ReaderT< 等构造函数，等等。我读过《Real World Haskell》、《Learn You a Haskell
scala - 提升 `??` 结构
我浏览了电梯的MegaProtoUser遇到这种结构:??("Last Name")。谁能解释一下，这是什么意思？谢谢解答最佳答案它是在对象 S 上定义的: def ??(str : Strin
多值日期字段的 Solr 提升
我有一个Solr索引，每个文档都是一个Event的信息。在我的架构中，Schedule 是日期类型的多值字段。我想知道是否可以使用计划日期来增加文档(多值字段中的任何日期)在未来并且最接近当前日期？我
scala - 提升:如何使用设计人员友好的模板构建表单？
作为测试，我正在尝试使用设计人员友好的模板在 lift 中创建一个表单。我正在使用 Lift 2.5 我已经设法使用 toForm 创建了一个工作表单，但我只是在探索所有可能的方法。我的 html
c++ - 重置条件变量(提升)
如果这个问题已经被问到，我深表歉意。是否可以清除已经设置的条件变量？下面是我想要实现的详细信息: void worker_thread { while (wait_for_conditio
Javascript 提升 - 无法理解这一点
尝试学习Js，无法理解为什么DOM元素没有获取到值: var Car = function(loc) { var obj = Object.create(Car.prototype); obj
全局变量和函数的 JavaScript 提升
我想知道吊装。我知道如果全局函数名称与全局变量相同，函数会覆盖变量的名称。是吗？这是我的代码。 (function() { console.log('console.log#1 ' + glob
Javascript 提升、函数声明
这个问题已经有答案了: var functionName = function() {} vs function functionName() {} (41 个回答) 已关闭 7 年前。在javas
C++ winapi 提升
我正在开发 Windows 资源管理器 namespace 扩展。我的应用程序是explorer.exe在某个时候加载和使用的动态库。我需要我的 DLL 在 C:\中创建文件，有时在其他需要提升才能执
git - 提升 PR 前的内部审查
背景: GitHub 属于客户。我们团队中有一些新手，他们有时会错过基本的命名约定和其他编码协议(protocol)。所以，如果哪位前辈想在内部review，除了创建PR，别无他法。但是这个 PR 对
Delphi:需要时提示 UAC 提升
我们需要在运行时更改 HKEY_LOCAL_MACHINE 的一些设置。如果需要在运行时，是否可以提示 uac 提升，或者我是否必须启动第二个提升的进程来完成“肮脏的工作”？最佳答案我会以提升的
haskell - 提升(在函数式编程上下文中)与类别理论有何关系？
看着Haskell文档，提升似乎基本上是 fmap 的概括，允许映射具有多个参数的函数。 Wikipedia然而，关于提升的文章给出了不同的观点，根据类别中的态射来定义“提升”，以及它如何与类别中的其
r - 提升 ggplot2 性能
ggplot2 package 很容易成为我用过的最好的绘图系统，除了对于较大的数据集(约 50k 点)性能不是很好。我正在研究通过 Shiny 提供网络分析，使用 ggplot2作为绘图后端，但我对
powershell - 提升 Powershell 脚本
是否可以提升 powershell 脚本的权限，以便没有管理员权限的用户可以运行该脚本？我们的网络管理员正在尝试寻找更省时的方法来完成某些任务，目前他们必须使用远程桌面...使用 PS 脚本将其自动化

首页

博学

6Ren·AI

商城

algorithm - AlphaGo self 提升