- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
我使用具有一个节点的 Hadoop 和 YARN 集群。所有 hadoop 和 yarn 守护进程都在这个节点中启动。我还使用 Apache Nutch 1.15 分布式爬网启动了一个获取步骤,成功完成了注入(inject)和生成步骤。
我正在尝试使用 Selenium 3.149.54 FirefoxDriver 在 YarnChild 容器上运行的 map task 中运行 Firefox 浏览器。 Firefox 进程启动,但弹出一个窗口,提示 Firefox 配置文件丢失或无法访问, map task 被阻止,直到我关闭该窗口。
Selenium 3.141.54 FirefoxDriver 使用 geckodriver 启动 Firefox,从容器用户日志的标准错误日志中的 geckodriver 输出,我看到它尝试使用以下命令运行 Firefox:
1557726792743 mozrunner::runner INFO Running command: "/usr/bin/firefox" "-marionette" "-profile" "/tmp/rust_mozprofile.0dQXae46ZwUd" "-foreground" "-no-remote"
我注意到的是,如果我错了请纠正我,在映射任务中我可以从主机本地文件系统访问二进制文件,比如/usr/bin/firefox,但是不知何故,当 firefox 在内部启动时一个映射任务,由 FirefoxDriver 使用位于主机本地文件系统中的 geckodriver,使用上面的命令,Firefox 进程看不到位于主机本地 fs/tmp 中的“/tmp/rust_mozprofile.0dQXae46ZwUd”目录。
我已尝试将 FirefoxDriver 设置为使用位于 hdfs 中的配置文件,该配置文件与/tmp 中的临时配置文件具有相同的信息,但仍然出现表示配置文件丢失或无法访问的窗口。
我尝试使用 hadoop LocalFileSystem API 从映射任务中读取主机本地文件系统/tmp 中的文件,我可以读取它,因此我可以从映射任务访问本地文件系统。
了解所有这些后,我无法理解为什么 geckodriver 无法使用/tmp 中的配置文件启动 Firefox。
下面的代码是从getProtocolOutput调用嵌套函数某处运行的主要代码,从FetcherThread开始,在FetcherRun mapper中启动。简单的说,下面的代码运行在一个Mapper中启动的特定线程中:
profile = new FirefoxProfile();
boolean enableFlashPlayer = conf.getBoolean("selenium.firefox.enable.flash", false);
int loadImage = conf.getInt("selenium.firefox.load.image", 1);
int loadStylesheet = conf.getInt("selenium.firefox.load.stylesheet", 1);
System.setProperty("webdriver.gecko.driver", conf.get("webdriver.gecko.driver"));
profile.setPreference("dom.ipc.plugins.enabled.libflashplayer.so", enableFlashPlayer);
profile.setPreference("permissions.default.stylesheet", loadImage);
profile.setPreference("permissions.default.image", loadStylesheet);
profile.setPreference("marionette", false);
profile.setAcceptUntrustedCertificates(true);
long firefoxBinaryTimeout = conf.getLong("selenium.firefox.binary.timeout", 45);
binary = new FirefoxBinary();
binary.setTimeout(TimeUnit.SECONDS.toMillis(firefoxBinaryTimeout));
binary.addCommandLineOptions("-profile", "/home/iulian/firefox.profile");
options = new FirefoxOptions();
options.setBinary(binary).setProfile(profile);
driver = new FirefoxDriver(options); // the execution stop here and the window appears, which says that firefox profile is missing or is inaccessible
System.out.println("Finished starting driver.");
long pageLoadWait = conf.getLong("libselenium.page.load.delay", 10);
driver.manage().timeouts().pageLoadTimeout(pageLoadWait, TimeUnit.SECONDS);
您认为问题出在哪里?如何以简单的方式调试对/tmp 的访问?
提前致谢!
最佳答案
我已经找到问题了。
当启动 Firefox 浏览器时,此浏览器需要有一个具有有效 HOME 环境变量路径目录的环境,这意味着主目录应对应于启动浏览器的当前用户,用于创建 firefox 配置文件相关文件。
在我的例子中,来自 Hadoop 的映射任务的问题在于 HOME 环境变量只是“HOME=/home/”。我对执行 map task 的用户没有这个目录的写权限,隐式地对 firefox 浏览器没有写权限。所以每次出现的弹窗都是因为firefox浏览器无法在HOME目录下创建profile相关文件。
关于hadoop - 能否在 Hadoop 集群中的 Map Task 中启动特定进程?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56118804/
我是 Linux 的新手,并且继承了保持我们的单一 Linux 服务器运行的职责。这是我们的SVN服务器,所以比较重要。 原来在我之前维护它的人有一个 cron 任务,当有太多 svnserve 进程
Node 虽然自身存在多个线程,但是运行在 v8 上的 JavaScript 是单线程的。Node 的 child_process 模块用于创建子进程,我们可以通过子进程充分利用 CPU。范例:
Jenkins 有这么多进程处于事件状态是否正常? 我检查了我的设置,我只配置了 2 个“执行者”... htop http://d.pr/i/RZzG+ 最佳答案 您不仅要限制 Master 中的执
我正在尝试在 scala 中运行这样的 bash 命令: cat "example file.txt" | grep abc Scala 有一个特殊的流程管道语法,所以这是我的第一个方法: val f
很难说出这里要问什么。这个问题模棱两可、含糊不清、不完整、过于宽泛或夸夸其谈,无法以目前的形式得到合理的回答。如需帮助澄清此问题以便重新打开,visit the help center . 关闭 1
我需要一些帮助来理解并发编程的基础知识。事实上,我读得越多,就越感到困惑。因此,我理解进程是顺序执行的程序的一个实例,并且它可以由一个或多个线程组成。在单核CPU中,一次只能执行一个线程,而在多核CP
我的问题是在上一次集成测试后服务器进程没有关闭。 在integration.rs中,我有: lazy_static! { static ref SERVER: Arc> = {
我正在使用 Scala scala.sys.process图书馆。 我知道我可以用 ! 捕获退出代码和输出 !!但是如果我想同时捕获两者呢? 我看过这个答案 https://stackoverflow
我正在开发一个C++类(MyClass.cpp),将其编译为动态共享库(MyClass.so)。 同一台Linux计算机上运行的两个不同应用程序将使用此共享库。 它们是两个不同的应用程序。它不是多线程
我在我的 C 程序中使用 recvfrom() 从多个客户端接收 UDP 数据包,这些客户端可以使用自定义用户名登录。一旦他们登录,我希望他们的用户名与唯一的客户端进程配对,这样服务器就可以通过数据包
如何更改程序,以便函数 function_delayed_1 和 function_delayed_2 仅同时执行一次: int main(int argc, char *argv[]) {
考虑这两个程序: //in #define MAX 50 int main(int argc, char* argv[]) { int *count; int fd=shm
请告诉我如何一次打开三个终端,这样我的项目就可以轻松执行,而不必打开三个终端三次然后运行三个exe文件。请问我们如何通过脚本来做到这一点,即打开三个终端并执行三个 exe 文件。 最佳答案 在后台运行
我编写了一个监控服务来跟踪一组进程,并在服务行为异常、内存使用率高、超出 CPU 运行时间等时发出通知。 这在我的本地计算机上运行良好,但我需要它指向远程机器并获取这些机器上的进程信息。 我的方法,在
关闭。这个问题不符合Stack Overflow guidelines .它目前不接受答案。 想改进这个问题?将问题更新为 on-topic对于堆栈溢出。 8年前关闭。 Improve this qu
我有一个允许用户上传文件的应用程序。上传完成后,必须在服务器上完成许多处理步骤(解压、存储、验证等...),因此稍后会在一切完成后通过电子邮件通知用户。 我见过很多示例,其中 System.Compo
这个问题对很多人来说可能听起来很愚蠢,但我想对这个话题有一个清晰的理解。例如:当我们在 linux(ubuntu, x86) 上构建一个 C 程序时,它会在成功编译和链接过程后生成 a.out。 a.
ps -eaf | grep java 命令在这里不是识别进程是否是 java 进程的解决方案,因为执行此命令后我的许多 java 进程未在输出中列出。 最佳答案 简答(希望有人写一个更全面的): 获
我有几个与内核态和用户态的 Windows 进程相关的问题。 如果我有一个 hello world 应用程序和一个暴露新系统调用 foo() 的 hello world 驱动程序,我很好奇在内核模式下
我找不到很多关于 Windows 中不受信任的完整性级别的信息,对此有一些疑问: 是否有不受信任的完整性级别进程可以创建命名对象的地方? (互斥锁、事件等) 不受信任的完整性级别进程是否应该能够打开一
我是一名优秀的程序员,十分优秀!