python - 返回网页内容之前等待-6ren

python - 返回网页内容之前等待

转载作者：太空宇宙更新时间：2023-11-03 13:56:25

24

4

我正在尝试抓取此网站:http://www.fivb.org/EN/BeachVolleyball/PlayersRanking_W.asp ，但此页面在页面加载后加载表的内容(可能通过 AJAX)。

我的尝试:

import requests
from bs4 import BeautifulSoup, Comment
uri = 'http://www.fivb.org/EN/BeachVolleyball/PlayersRanking_W.asp'

r = requests.get(uri)
soup = BeautifulSoup(r.content) 
print(soup)

但是无论我做什么，带有 id='BTechPlayM' 的 div 仍然是空的。我试过:

设置请求超时:requests.get(uri, timeout=10)
传递 header
使用 eventlet 设置延迟
最近的事情是尝试使用 selenium-library，使用 PhantomJS ( installed from NPM )，但是这个兔子整体越来越深入。

有没有办法向 URI 发送请求，等待 X 秒，然后返回内容？

...或者要向 URI 发送请求，请继续检查 div 是否包含元素；并且无论什么时候都只返回内容？

最佳答案

简短回答:不。您不能使用请求来做到这一点。

但是，正如您所说，表数据是使用 JavaScript 动态生成的。数据取自this URL 。但是，响应不是 JSON 格式；这是 JavaScript。因此，从该数据中，您可以使用 RegEx 获取列表中可用的所需数据。

但是，RegEx 返回的数据是字符串格式，而不是实际的列表。您可以使用 ast.literal_eval() 将此字符串转换为列表。例如，数据如下所示:

'["1", "Humana-Paredes", "CAN", "4", "1,720", ""]'

完整代码:

import re
import requests
import ast

r = requests.get('http://www.fivb.org/Vis/Public/JS/Beach/TechPlayRank.aspx?Gender=1&id=BTechPlayW&Date=20180326')
data = re.findall(r'(\[[^[\]]*])', r.text)
for player in data:
    details = ast.literal_eval(player)
    print(details)  # this var is a list (format shown below)

部分输出:

['1', 'Humana-Paredes', 'CAN', '4', '1,720', '']
['', 'Pavan', 'CAN', '4', '1,720', '']
['3', 'Talita', 'BRA', '4', '1,660', '']
['', 'Larissa', 'BRA', '4', '1,660', '']
['5', 'Hermannova', 'CZE', '4', '1,360', '']
['', 'Slukova', 'CZE', '4', '1,360', '']
['7', 'Laboureur', 'GER', '4', '1,340', '']
...

此列表的基本格式(详细信息)是:

[<Rank>, <Name>, <Country>, <Nb. part.>, <Points>, <Entry pts.>]

您可以根据需要使用这些数据。例如，使用 details[1] 将为您提供所有名称。

关于python - 返回网页内容之前等待，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/49572469/

24

4

0

文章推荐： Java HttpURLConnection 使用弱密码连接

文章推荐： python - grequests - 打开文件太多错误

文章推荐： python - 添加 alpha channel 时图像不会改变

KitKat 之前(api 18 之前)的 Android HTML 代码打印
我正在寻找一种使此打印 HTML 代码 fragment 向后兼容旧 Android 版本的简单方法: @TargetApi(Build.VERSION_CODES.KITKAT) private v
c - 错误 : expected ‘:’ , ‘,’ 、 ‘;’ 、 ‘}’ 或 ‘__attribute__’ 在 ‘=’ token 之前 & 错误:预期 ‘)’ 在 ‘va’ 之前
我在 GCC 终端 (centos linux) 中为 ATM 项目编译以下 c 和 .h 代码时收到以下错误。请帮忙，因为我是编程新手。 validate_acc.h #ifndef _VALIDA
css - 为什么文本节点默认呈现在其父级`::之前？
在写关于 SO 的不同问题的答案时，我制作了这个片段: @import url('https://fonts.googleapis.com/css?family=Shadows+Into+Light'
javascript - 之前，不更换
试图弄清楚我应该如何在 my_div_class 之前放置一个 span 而不是替换所有它。现在它取代了 div，但我不想这样做。我假设它类似于 :before 但不知道如何使用它。 { va
CSS如何使选择选项出现在 slider 之前？
我正在使用选择库 http://github.hubspot.com/select/和 noUiSlider https://refreshless.com/nouislider/ .我面临的问题如下
xcode - 为什么不提交对版本控制的更改......之前
我是开发新手，独自工作。我正在使用 Xcode 和 git 版本控制。可能我没有适本地组织和做错事，但我通常决定做 promise 只是为了在我破坏一切之前做出安全点。在那一刻，我发现很难恰本地描述我
java - 我如何确保写入发生在同一存储桶和同一键上的不同线程同时读取 concurrenthashmap 之前？
我想确保在同一个桶和键上读取和写入时，应该更新获取的值，也就是说，应该在对其进行写入操作之后获取它。我怎样才能做到这一点？我想要的是，如果我更新一个键的值，如果我同时使用不同线程获取值，则更新同一个
Java 发生在关系 invokeAndWait 之前
我的问题与this有关问题，已经有了答案: yes, there is a happens-before relationship imposed between actionsof the thre
rspec - 在RSpec中，之前(:suite) and before(:all)?
The before and after hook documentation on Relish仅显示 before(:suite) 在 before(:all) 之前调用。我什么时候应该使用其中
javascript - 正则表达式仅获取特定字符，之前/之后没有任何内容
我有 CSV 行，我想在其中检测所有内部双引号，没有文本限定符。这几乎可以正常工作，但我的正则表达式还可以检测双引号后的字符。 CSV 部分: "7580";"Lorem ipsum";"";"Lor
video - 通过Youtube数据API识别是否可以在特定视频上/之前/旁边显示广告
是否可以通过Youtube数据API检查广告是否可以与特定视频一起显示？我了解contentDetails.licensedContent仅显示视频是否已上传至同一伙伴然后由其声明版权。由于第三者权
javascript - 在布局*之前*对窗口调整大小事件使用react
考虑一下用漂亮的彩色图表描述的“像素管道” https://developers.google.com/web/fundamentals/performance/rendering/ 我有一个元素(比
.net - 在MVC3中如何将所有脚本移动到页面底部的之前？
在 MVC3 中，我可以轻松地将 jQuery 脚本标签移动到页面底部“_Layout.vbhtml” 但是，在 ASP.NET MVC3 中，当您使用编辑器模板创建 Controller 时，脚手
jquery - 返回到使用 .text() 之前
悬停时内容被替换，但是当鼠标离开元素时我希望它变回来。我该怎么做？ $('.img-wrap').hover(function(){ $(this).find('h4').text('Go
C 期望标识符或 ‘(’ 在 ‘{’ 之前
已关闭。这个问题是 not reproducible or was caused by typos 。目前不接受答案。这个问题是由拼写错误或无法再重现的问题引起的。虽然类似的问题可能是 on-top
c - 预计在 elseif 之前
已关闭。这个问题是 not reproducible or was caused by typos 。目前不接受答案。这个问题是由拼写错误或无法再重现的问题引起的。虽然类似的问题可能是 on-top
c - 预期说明符限定符列表位于 'if' 之前
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。已关闭 9 年前。有关您编写的代码问题的问题必须在问题本身中描述具体问题 - 并包含有效代码以重现该问题。
c++ - 预期类型说明符位于 'QwtLog10ScaleEngine' 之前？
版本:qwt 6.0.1我尝试开发频谱的对数缩放。我使用简单的线条来启用缩放plotspectrum->setAxisScaleEngine(QwtPlot::yLeft, new QwtLog10S
c# - 插入触发器 SQL 之前
我有两个相同的表，I_Subject 和 I_Temp_Subject，我想将 Temp_Subject 表复制到 Subject 表。 I_Temp_Subject 由简单用户使用，I_Subjec
javascript - 第一次绘制如何发生在 DOMContentLoaded 之前？
我的印象是第一次绘制发生在触发 DOMContentLoaded 事件之后。特别是，因为我认为为了让第一次绘制发生，需要渲染树，它依赖于 DOM 构造。另外，我知道 DOM 构造完成时会触发 DOMC

首页

博学

6Ren·AI

商城

python - 返回网页内容之前等待