R 错误使用 readHTMLTable-6ren

R 错误使用 readHTMLTable

转载作者：行者123 更新时间：2023-12-04 10:08:15

24

4

我正在使用以下代码:

url  = "http://finance.yahoo.com/q/op?s=DIA&m=2013-07"

library(XML)
tabs = readHTMLTable(url, stringsAsFactors = F)

我收到以下错误:

Error: failed to load external entity "http://finance.yahoo.com/q/op?s=DIA&m=2013-07"

当我在浏览器中使用 url 时，它工作正常。那么，我在这里做错了什么？

谢谢

最佳答案

很难确定，因为我无法复制您的错误，但根据包的作者(请参阅 http://comments.gmane.org/gmane.comp.lang.r.mac/2284 )，XML 获取 Web 内容的方法非常简单。解决方法是使用 RCurl获取内容和XML解析它:

library(XML)
library(RCurl)

url <- "http://finance.yahoo.com/q/op?s=DIA&m=2013-07"

tabs <- getURL(url)
tabs <- readHTMLTable(tabs, stringsAsFactors = F)

或者，如果 RCurl仍然抛出错误，试试 httr包裹:

library(httr)

tabs <- GET(url)
tabs <- readHTMLTable(rawToChar(tabs$content), stringsAsFactors = F)

关于R 错误使用 readHTMLTable，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/17045107/

24

4

0

文章推荐： kendo-ui - 剑道网格批量编辑 - 一次调用即可保存

文章推荐： asp.net - EF 是否在 DbContext 的不同实例之间缓存实体？

文章推荐： apache - HTTPS 网站的 ELB 和 Apache 配置

readHTMLTables -- 检索与政府首脑相关的文章的国家名称和 url
我想制作一张真实世界总统的 map 。为此，我想从维基百科中抓取每位总统的图像。第一步是从 wiki 页面获取数据: http://en.wikipedia.org/wiki/List_of_cu
R 错误使用 readHTMLTable
我正在使用以下代码: url = "http://finance.yahoo.com/q/op?s=DIA&m=2013-07" library(XML) tabs = readHTMLTable(
R 在对维基百科的 readHTMLTable 调用时崩溃
试图抓取维基百科页面，我以前做过很多次类似的事情 library(XML) myURL 2 Location
xml - R readHTMLTable 无法加载外部实体
这个问题在这里已经有了答案: R Error using readHTMLTable (2 个答案) 关闭 7 年前。当我在笔记本电脑上运行这条线时， table500 <- readHTMLTa
删除 XML 包中 readHTMLTable 中的标签
我正在尝试从以下网址的表格中抓取数据: http://www.nfpa.org/itemDetail.asp?categoryID=953&itemID=23033 问题是包含在标签。当我使用以
使用 readHTMLTable 从 https 网页读取表格
我安装了 R 3.3.1 并使用 RStudio 0.99.903。我正在尝试从以下 URL 将表读入 R:https://www.fantasypros.com/nfl/rankings/conse
r - R 中的网页抓取 readHTMLTable 函数出现错误
我正在 R 中自学一些基本的表格网页抓取技术。。但我在运行函数 readHTMLTable 时看到错误. unable to find an inherited method for functio
html - R 中 readHTMLTable 的问题
我试图使用 readHTMLTable 将一些数据存储在 R Studio 的数据框中，但它一直告诉我找不到函数“ReadHTMLTable”。我不明白我哪里做错了。有人可以花很多时间告诉我如何解决这
R 中的 XML 包 - readHTMLTable 和多行类
我正在尝试从此网站抓取数据 Extra Skater 进入数据框。从 HTML 代码中我可以看出，有多个行类，您可以通过它们切换以显示不同的表行。我只对具有标签的行感兴趣: 例如: 5v5
html - 使用 readHTMLTable 检索 html 表
我正在尝试在 R 中检索 SGX 网站的价格。 myUrl="http://www.sgx.com/wps/portal/sgxweb/home/marketinfo/securities/etfs/
html - 将 readHTMLTable 与多个 tbody 一起使用
假设我有一个包含多个的 HTML 表格，这we know is perfectly legal HTML , 并尝试用 readHTMLTable 读取它如下: library(XML) tabl
xml - 如何使用 readHTMLTable 从 HTML 表格中获取超链接？
这个问题在这里已经有了答案: Extract links from html table (2 个答案) 关闭 9 年前。我有一个 XMLNodeSet 对象，它包含一个带超链接的 HTML 表格
xml - 如何使用 XML 和 ReadHTMLTable 抓取多个页面？
我正在使用 XML 包将芝加哥马拉松比赛的结果抓取到 CSV 文件中。问题是该站点只能在单个页面上显示 1,000 个运行者，因此我必须抓取多个页面。到目前为止，我编写的脚本适用于第一页: rm(li
xml - readHTMLTable 和 UTF-8 编码
我一般在 readHTMLTable 和 XML 包中遇到编码问题。我想从波兰网站 allegro.pl(类似于 ebay 的拍卖网站)下载一些表格，但之后，波兰字体存在编码问题，即使我在中使用 en
html - 如何在 R 中使用 readHTMLTable 读取注释掉的 HTML 表格
过去，我已经能够使用 R 中的 readHTMLTable 来提取一些足球统计数据。今年再次尝试这样做时，表格没有显示，即使它们在网页上可见。这是一个例子:http://www.pro-footbal
xml - 如何在 R 中抓取安全页面(https 链接)(使用 XML 包中的 readHTMLTable)？
SO 上有关于如何使用 XML 包中的 readHTMLTable 的很好的答案，我用常规的 http 页面做到了，但是我无法用 https 页面解决我的问题。我正在尝试读取此网站上的表格(url
xml - 使用 XML/RCurl R 包解析 HTML 表，而不使用 readHTMLTable 函数
我正在尝试从单个 html 表中抓取/提取数据:http://www.theplantlist.org/tpl/record/kew-419248和一些非常相似的页面。我最初尝试使用以下函数来读取表格

首页

博学

6Ren·AI

商城

R 错误使用 readHTMLTable