javascript - 如何使用 R 从 javascript 饼图中抓取网络数据？-6ren

javascript - 如何使用 R 从 javascript 饼图中抓取网络数据？

转载作者：行者123 更新时间：2023-11-29 19:08:50

25

4

我有:

library(XML)

my_URL <- "http://www.velocitysharesetns.com/viix"

tables <- readHTMLTable(my_URL)

以上仅输出位于页面顶部的表格。看起来饼图被忽略了，javascript 的事实解释了它。是否有任何简单的解决方案来提取图表中的两个 % 数字？

查看了 RSelenium 但是我遇到了一些错误，我无法找到任何解决方案。

> RSelenium::startServer()
Error in if (file.exists(file) == FALSE) if (!missing(asText) && asText ==  : 
  argument is of length zero
In addition: Warning messages:
1: startServer is deprecated.
Users in future can find the function in file.path(find.package("RSelenium"), "example/serverUtils").
The sourcing/starting of a Selenium Server is a users responsiblity. 
Options include manually starting a server see vignette("RSelenium-basics", package = "RSelenium")
and running a docker container see  vignette("RSelenium-docker", package = "RSelenium") 
2: running command '"java" -jar "\\med-fs01/Home/Alex.Badoi/R/win-library/3.3/RSelenium/bin/selenium-server-standalone.jar" -log "\\med-fs01/Home/Alex.Badoi/R/win-library/3.3/RSelenium/bin/sellog.txt"' had status 127 
3: running command '"wmic" path win32_process get Caption,Processid,Commandline /format:htable' had status 44210 
>

根据 Phillip 的回答，我想出了流畅的解决方案:

library(XML)



# extarct HTML

doc.html = htmlTreeParse('http://www.velocitysharesetns.com/viix',
                         useInternal = TRUE)


# convert to text

htmltxt <- paste(capture.output(doc.html, file=NULL), collapse="\n")

# get location of string

pos = regexpr('CBOE SHORT-TERM VIX FUTURE', htmltxt)

# extarct from "pos" to nchar to end of string 

keep = substr(htmltxt, pos, pos+98)

输出:

> keep
[1] "CBOE SHORT-TERM VIX FUTURE DEC 2016', 81.64],\n\n    ['CBOE SHORT-TERM VIX FUTURE JAN 2017', 18.36],\n"

最佳答案

使用 RSelenium

此解决方案适用于使用 Rselenium 的我(使用 Windows 7 并在检查网页源之后)。请注意，我使用的是 chromedriver.exe

library(RSelenium)
checkForServer(update = TRUE)

#### I use Chromedriver
startServer(args = c("-Dwebdriver.chrome.driver=C:/Stuff/Scripts/chromedriver.exe")) 

remDr <- remoteDriver(remoteServerAddr = "localhost", browserName="chrome", port=4444)

### Open Chrome
remDr$open()

remDr$navigate("http://www.velocitysharesetns.com/viix")

b <- remDr$findElements(using="class name", value="jqplot-pie-series")

sapply(b, function(x){x$getElementAttribute("outerHTML")})

最后一条命令返回

[[1]]
[1] "<div class=\"jqplot-pie-series jqplot-data-label\" style=\"position: absolute; left: 100px; top: 106px;\"><div style=\"color:white;font-weight:bold;\">82%</div></div>"

[[2]]
[1] "<div class=\"jqplot-pie-series jqplot-data-label\" style=\"position: absolute; left: 159px; top: 67px;\"><div style=\"color:white;font-weight:bold;\">18%</div></div>"

您可以看到百分比数字出现在那里并且可以轻松提取。

只使用纯 html

此外，数据也可以通过读取 html 源来获取，因为数据已经包含在内。在源代码的某处你会发现:

<script type="text/javascript" language="javascript">
$(document).ready(function(){
var data = [


['CBOE SHORT-TERM VIX FUTURE DEC 2016', 81.64],

['CBOE SHORT-TERM VIX FUTURE JAN 2017', 18.36],

];

这就是您要找的。数字在图中四舍五入。

关于javascript - 如何使用 R 从 javascript 饼图中抓取网络数据？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/40741593/

25

4

0

文章推荐： PHP 函数不返回 TRUE

文章推荐： android - 系统崩溃时如何生成 ramdumps？

文章推荐： android - 请求 MTU 在牛轧糖中不起作用

文章推荐： php - 提供的参数无效 Codeigniter

Matlab 填充 contour3 图，如 contourf 图
我想填充 3D 等高线图 (contour3(X,Y,Z))，就像 2D 等高线填充图 (contourf(X,Y,Z))。但我无法弄清楚如何实现这一目标。 contour3 和 surf 的组合不是
javascript - c3.js - 带有工具提示的 c3 图，里面有 c3 图
我有一个 c3.js 折线图，表示 2 个值的演变。我需要折线图的工具提示是饼图(工具提示 = 另一个 c3.js 图形)。这是我成功的: http://jsfiddle.net/owhxgaqm/
pandas - 来自 Pandas Dataframe 的 Seaborn fiddle 图，每列都有自己单独的 fiddle 图
我有具有结构的 Pandas 数据框: A B 0 1 1 1 2 1 2 3 4 3 3 7 4 6 8 如何生成 Seaborn Violin 图，每列作为其自己的单独
c++ - 基于 2D 图 block 的游戏，当我用相机放大时，图 block Sprite 之间会出现间隙吗？
我正在使用 D3DXSPRITE 方法将我的 map 图 block 绘制到屏幕上，我刚刚添加了一个缩放功能，当您按住向上箭头时会放大，但注意到您现在可以看到图 block 之间的间隙，这是一些屏幕截
数据结构-图
今天我们开始学习目前学习到的最难最复杂的数据结构图。简单回顾一下之前学习的数据结构，数组、单链表、队列等线性表中数据元素是一对一关系，而树结构中数据元素是一对多关系，而图结构中数据元素则是多对
linux服务器磁盘扩容的方法(图)
1、系统环境如下图： 2、为该系统添加一块新的虚拟硬盘，添加后需重启虚拟机，否则系统不识别；如下图，/dev/sdc 是新添加的硬盘； 3、fdisk /dev/sdc为新硬盘创建分区：
基于Linux下Nagios的安装与配置说明介绍[图]
1、nagios简介　　nagios是一款开源的电脑系统和网络监视工具，能有效监控windows、linux和unix的主机状态，交换机路由器等网络设置，打印机等。在系统或服务状态异常时发
从亚马逊的7个例子中学会如何成功做好邮件营销(图)
越来越多人开始习惯用手机上网，浏览网页、查看邮件···移动化已经成为互联网发展必然趋势，包括facebook在内的很多互联网公司都将移动广告作为下一个淘金地
Android图片处理实例介绍(图)
1.图片处理 1.圆角图片复制代码代码如下: /** * 转换成圆角 * &n
sqlserver数据库导入数据操作详解(图)
Microsoft SQL Server Management Studio是SQL SERVER的客户端工具，相信大家都知道。我不知道大伙使用导入数据的情况怎么样，反正我最近是遇到过。主要是因为没
debian6配置mysql允许远程连接的方法(图)
debian6系统：首先先安装mysql吧：打开终端（root）用户登入 apt-get purge mysql-server-5.5 安装完成后：默认情况下Mysql只允许本地登录
fedora16英文环境下支持中文输入法的方法介绍(图)
fedora16英文环境下支持中文输入法的方法 fedora16英文环境下支持FCITX的中文输入法： $ im-chooser 就会出现选择界面，选择第二个就行了。
.net预编译命令详解(图)
Net预编译命令 C:\WINDOWS\Microsoft.NET\Framework\v2.0.50727\aspnet_compiler.exe -? 显示说明我们需要选择的命令为&n
主板BIOS恢复出厂设置的方法[图]
有的时候电脑出现一些故障有的时候通过将其修改bios设置的方法来解决故障，那么在bios上设置能不能将电脑恢复出厂设置呢?其实也是可以的。方法也很简单的，只要会进入电脑的bios懂的上面英文的意思就
[图]Deepin系统首次在龙芯3号电脑上运行成功
笔者曾介绍过Deepin 将对龙芯进行全面支持，打造最优美龙芯电脑桌面。现在Deepin团队移植工作取得了突破性的成果，Deepin桌面已经在龙芯3A和龙芯3B电脑上成功运行起来了。以下为龙芯3
通过锁定Win7注册表编辑器来防止主页被篡改的方法(图)
在安装一些软件之后，我们的电脑总是会发生一点小变化，不是桌面上多了几个网址图标，就是IE浏览器的默认主页被篡改成乱七八糟的网址。最可气的是，在IE设置中将默认主页改回来后，下次启动Win7后又变了回
常用的注册表编辑器打开的方法汇总(图)
“注册表编辑器怎么打开”虽说不是很难的问题，但是对于对电脑常识不是很擅长的网民来说，当电脑出现问题或需要更改设置时，着实还是件头疼的问题。因为需要打开注册表进行操作解决。那么如何打开注册表编辑器呢?
WordPress建站的10个重要的安全插件和技巧(图)
这篇文章重点介绍10个重要的WordPress安全插件和技巧，用来保护WordPress网站或者博客。 1. WP Security 人工帮助你修复被黑客入侵的网站，只要按照他们网站上的联系电话
实现dedecms友情链接分栏目调用的方法(图)
其实运用object和javascript调用外部文件，也能实现不同栏目调用不同友情链接，即相当于调用不同栏目友情链接文件， {dede:field.typeid/}来获取当前栏目的ID。
复数矩阵的 R 图
我有一个复值矩阵。如果我发出命令: plot(myMatrix) 然后它在图形设备上显示一种散点图，X 轴标记为 Re(myMatrix)，Y 轴标记为 Im(myMatrix)。这显示了我正在寻找

首页

博学

6Ren·AI

商城

javascript - 如何使用 R 从 javascript 饼图中抓取网络数据？