- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我目前正在开发一个使用 webparsing 并将 selenium 与 phantomJS
结合使用的项目。
我写的项目运行良好,但问题是它很慢,所以我想我可能会在其中引入多线程。
我知道 selenium 不是多线程安全的,每个线程都应该有自己的 webdriver(明确一点)。
重点是:
我有一个包含在 url 中使用的对象的数组(只有一部分)目前我为对象运行 for 循环并将驱动程序导航到给定的 xpath,获取数据并初始化对象。为了更快地完成它,我想创建 4 个线程,每个线程应该:
初始化新的网络驱动
从列表中获取尚未使用的项目。
在此对象上调用不同的函数
我不确定我应该如何开始创建多个驱动程序并将它们放在一起。我应该如何创建负责工作的线程?我已经阅读了有关运行覆盖功能的信息,并且这个地方应该有线程应该做的工作,但是它应该如何知道要使用的列表中的下一个元素?
到目前为止,我有以下内容:
public static class MyThread implements Runnable {
private Objectx object
private WebDriver driver;
public MyThread(Objectx object){
this.object = object;
}
@Override
public void run() {
driver = driverSettings(driver);
driver.navigate().to("website" + object.getNumber + ".html");
function1(object);
function2(object);
}
}
在主要方法中:
ExecutorService executor = Executors.newFixedThreadPool(4);
现在我有了对象列表
private static List<Objectx> listOfObjects = new ArrayList<Objectx>();
然后我可以使用:
For (Objectx object : listOfObjects){
Runnabble object.getNumber() = new MyThread(object).start()
}
或者我应该如何添加所有对象来创建可运行列表?
最佳答案
这是基本步骤。
1) 创建一个线程池。线程数不取决于要处理的对象的大小。例如。您可以创建一个包含 4 个线程的池来处理 250 个对象。
2) 创建线程时,将对象列表传递给它的构造函数。
3) 每个线程从列表中获取下一个对象并将其从列表中删除。您可以使用队列而不是列表。
4)重要:对列表(队列)的访问应该是同步的,这样一次只有一个线程可以修改它。最简单的方法之一是使用 ConcurrentLinkedQueue。
5) run() 中的每个线程从列表(从队列)中检索下一个任务,处理它,检索下一个任务。如果没有更多任务,线程将退出其 run() 方法。
更新 1:(问题更新后)
名称“MyThread”具有误导性,因为它不是线程。我建议您根据它的作用来命名它,例如“WebSiteParser”。但对于功能结果来说,这并不重要:)
当您创建可运行的实例时,您应该将它们提交给执行者。它将根据池中的线程数执行它们。
更新 2:
关于Web Driver的复用:如果你使用ExecutorService,那么我建议你提前创建Web Driver,把它们放到一个栈或者一个队列中。当一个线程开始它的任务时,它应该从这个堆栈或队列中获取一个 Web 驱动程序。当它完成它的任务时,它应该将它的 Web Driver 放回堆栈或队列中。再次确保对此堆栈或队列的访问是线程安全的。
关于java - 多线程/并发运行 selenium Windows,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/58259882/
我正在尝试在多线程环境中实现某种累积逻辑;我想知道没有 lock 和 synchronized 关键字是否有更好/更快的方法来做到这一点?以下是我当前的代码: public class Concurr
我需要帮助构建一个实现信号量的监视器,简单的 C 示例就可以。 这是为了证明可以在任何可以使用信号量的地方使用监视器。 最佳答案 如果您说允许使用互斥锁/condvars,请检查: #include
我已经构建了一些返回部分产品目录的 ajax,并且我正在尝试将 xml 输出到文档中,到目前为止,这是我所拥有的: $("#catalog").append("Item NamePriceDe
很抱歉,如果我的问题之前已经被问过,或者它太明显了,但我真的需要澄清这一点。感谢您的帮助。 在多用户界面中,如果来自不同用户的相同事务同时到达服务器,会发生什么? 我有下一张表: create tab
这可能是一个愚蠢的问题,但是这个程序的输出(它的方式)可以为零吗? public class Test2{ int a = 0; AtomicInteger b = new Atomi
假设我本地主机上的一个网站处理每个请求大约需要 3 秒。这很好,正如预期的那样(因为它在幕后进行了一些奇特的网络)。 但是,如果我在选项卡(在 firefox 中)中打开相同的 url,然后同时重新加
我对 MongoDB 的读锁定有点困惑。单个集合可以支持多少个并发读取操作? 最佳答案 如 tk 给出的链接中所写:http://www.mongodb.org/pages/viewpage.acti
如果有四个并发的 CUDA 应用程序在一个 GPU 中竞争资源会发生什么这样他们就可以将工作卸载到图形卡上了? Cuda Programming Guide 3.1 提到那里 某些方法是异步的: 内核
👊上次的百度面试遇到了关于spark的并发数的问题,今天我们就来将这些问题都一并解决一下,图画的的有点丑,还行大家见谅,百度实习的问题我放在了下面的链接👇: 链接: 2022百度大数据开发工程师实
我对 Groovy 线程有疑问。 我的任务是以某种方式翻译给定目录中的每个文件 并将生成的输出放在其他目录中的文件中。 我编写了以下代码,该代码有效: static def translateDir(
Java中的同步和锁定有什么区别? 最佳答案 synchronized是语言关键字;锁是对象。 当一个方法或代码块被标记为同步时,您是说该方法或代码块必须先获得某个锁对象(可以在同步的语法中指定)才能
我需要创建一个能够同时处理来自客户端的多个请求的并发 RPC 服务器。 使用 rpcgen linux编译器(基于sun RPC),不支持-A为并发服务器创建 stub 的选项。 (-A 选项在 so
System.out.println("Enter the number of what you would like to do"); System.out.println("1 = Manuall
我正在将我的应用程序移植到 iOS 8.0 并注意到 UIAlertView 已被弃用。 所以我改变了使用 UIAlertController 的方法。这在大多数情况下都有效。 除了,当我的应用程序打
我正在逐行同时读取两个文本文件。 我特别想做的是当lineCount在每个线程上都是相同的我想看看扫描仪当前正在读取的字符串。 我环顾四周寻找可以实现的某些模式,例如 Compare and Swap
我正在阅读 Java Concurrency in Practice .在章节中断政策部分 取消和关闭 它提到 A task should not assume anything about the
我正在尝试学习线程,互斥等的基础知识。遵循here的文档和示例。在下面的代码中,我得到预期的输出。问题: 想确认我是否有任何陷阱?我们如何改善下面的代码? 我的线程在哪一行尝试获取互斥锁或正在等待互斥
并发是指两个任务在不同的线程上并行运行。但是,异步方法并行运行,但在同一个线程上。这是如何实现的?另外,并行性怎么样? 这三个概念有什么区别? 最佳答案 并发和并行实际上与您正确推测的原理相同,两者都
以此ConcurrentDouble类定义为例: public class ConcurrentDouble { public double num = 0; public void subt
在得知并发确实增加了许多人的吞吐量后,我一直计划在项目中使用并发。现在我在多线程或并发方面还没有做太多工作,因此决定在实际项目中使用它之前学习并进行简单的概念验证。 以下是我尝试过的两个示例: 1.
我是一名优秀的程序员,十分优秀!