- android - RelativeLayout 背景可绘制重叠内容
- android - 如何链接 cpufeatures lib 以获取 native android 库?
- java - OnItemClickListener 不起作用,但 OnLongItemClickListener 在自定义 ListView 中起作用
- java - Android 文件转字符串
我正在编写一个通用的 HTML 资源管理器,可以执行一系列操作,例如访问页面、查找表、查找行、存储数据等。它内部使用 Goutte/Guzzle,因此可以使用 CSS 和 XPath选择器。关于相对于现有结果集选择新结果集,我遇到了一个有趣的问题。
考虑这个演示 HTML:
<h2>Burrowing</h2>
<ul>
<li>
<a href="/jobs/junior-mole">Junior Mole</a>
</li>
<li>
<a href="/jobs/head-of-badger-partnerships">Head of Badger Partnerships</a>
</li>
<li>
<a href="/jobs/trainee-worm">Trainee Worm</a>
</li>
</ul>
<h2>Tree Surgery</h2>
<ul>
<li>
<a href="/jobs/senior-woodpecker">Senior Woodpecker</a>
</li>
<li>
<a href="/jobs/owl-supervisor">Owl Supervisor</a>
</li>
</ul>
<h2>Grass maintenance</h2>
<ul>
<li>
<a href="/jobs/trainee-sheep">Trainee sheep</a>
</li>
<li>
<a href="/jobs/sheep-shearer">Sheep shearer</a>
</li>
</ul>
<h2>Aerial supervision</h2>
<ul>
<li>
<a href="/jobs/head-magpie-ops">Head of Magpie Operations</a>
</li>
</ul>
我运行这个 CSS 查询来获取链接中的角色(这正确地获取了八个项目):
ul li a
对于每一个,我都想得到类别,即 <h2>
紧接在 <ul>
之前在每种情况下。现在我可以用一个绝对的 CSS 选择器来做到这一点:
h2
但是这会得到四个结果,所以我不知道哪个类别 (h2) 与哪个工作(链接)相关。我需要获得八个结果:第一类的三批、第二类的两批、第三类的两批和第四类的一批,因此每个类别都映射到每个角色。
我想知道是否为此需要一个父选择器,所以我从 CSS 切换到 XPath,并首先尝试了这个,它让每个 h2 都有一个紧随其后的列表项:
//h2[(following-sibling::ul)[1]/li/a]
找到具有指定父结构的 h2s,但再次返回四个结果 - 不好。
下一次尝试:
//ul/li[../preceding-sibling::h2[1]]
这会得到正确数量的结果(基于得到一个紧接其前的标题的列表项)但得到的是链接文本,而不是类别文本。
我想过做一个循环——我知道我有八个结果,所以我可以这样做(X 是一个从 1 到 8 循环的注入(inject)变量)。这行得通,但我认为在这里添加一个手动循环相当不雅——我试图让我的规则尽可能通用:
//li[X]/../preceding-sibling::h2[1]
是否有可以返回所需结果的 XPath 操作?为避免疑义,我正在寻找以下内容(或者只是文本元素就可以了):
<h2>Burrowing</h2>
<h2>Burrowing</h2>
<h2>Burrowing</h2>
<h2>Tree Surgery</h2>
<h2>Tree Surgery</h2>
<h2>Grass maintenance</h2>
<h2>Grass maintenance</h2>
<h2>Aerial supervision</h2>
CSS 也可以,但我认为这是不可能的,因为 CSS 没有父运算符(无论如何,Goutte 只是将 CSS 选择器转换为 XPath 选择器)。
由于我使用的是 PHP (5.5),我相信我必须坚持使用 XPath 1.0。
最佳答案
不,没有单一的 XPath 1.0 表达式可以返回您想要的内容。首先因为 XPath 1.0 不允许迭代中间结果,其次因为项目序列是 defined as a node-set - 其中不能有重复。
我可以看到两种可能的解决方案来解决您的问题。要么编写 PHP 代码
a
节点,例如使用像 //a
preceding::h2[1]
你必须自己编写 PHP 代码,因为我的技能很差。但我可以提供一个替代方案:您也可以使用 XSLT 1.0 转换,there are XSLT 1.0 processors在 PHP 中。
样式表
<?xml version="1.0" encoding="UTF-8" ?>
<xsl:transform xmlns:xsl="http://www.w3.org/1999/XSL/Transform" version="1.0">
<xsl:output method="xml" omit-xml-declaration="yes" indent="yes" />
<xsl:template match="/">
<xsl:for-each select="//a">
<xsl:copy-of select="preceding::h2[1]"/>
</xsl:for-each>
</xsl:template>
</xsl:transform>
应用于您的输入(添加根元素后),结果为
<h2>Burrowing</h2>
<h2>Burrowing</h2>
<h2>Burrowing</h2>
<h2>Tree Surgery</h2>
<h2>Tree Surgery</h2>
<h2>Grass maintenance</h2>
<h2>Grass maintenance</h2>
<h2>Aerial supervision</h2>
在线试用 here .顺便说一下,如果您对如何使用 for
在 XPath 2.0 中做到这一点感兴趣,正如您在评论中提到的那样,请参阅 this version instead :
for $a in //a return $a/preceding::h2[1]
关于php - 如何检索相对于找到的特定 HTML 节点的父元素文本?,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/28242541/
在开发中的网页上,我在 IE 上遇到此错误 element = $(element); 此代码位于prototype.js 预期对象 如何消除此错误。 更新: 现场也使用了 jQuery。 最佳答
我有两个大小相同的嵌套数组: Array1 =[[1, 2], [], [2, 3]] Array2= [[1, 4], [8, 11], [3, 6]] 我需要将它们合并到一个数组中,如下所示: A
我有一些 jQuery 代码,当单击具有特定 ID 的项目时运行。当 ID 是 的一部分时,它就可以工作。元素,但当它位于 中时则不然元素。为什么会这样呢?我想使用 an,因为如果用户关闭了 Ja
Flex-box 规范 3声明 flex 元素不是 block 容器: A flex item establishes a new formatting context for its content
我遇到了一个意想不到的问题。 HTML JS $(function() { var $divs = $('.myDiv'); // create new div not in
我使用 Bootstrap 和 Ember.js 得到了一个无序列表。每个列表项都是一个显示新帖子的链接,每当您单击该链接时,Ember 都会添加类 active默认情况下。我正在使用 Bootstr
我正在尝试让一个函数正常工作,但运气不佳,所以我想向 Stackoverflow 智囊团提出一个新手问题! 基本上,我有一个表单,并且循环遍历所有元素以查看是否存在自定义数据属性。如果存在,则保持该元
我想映射一个可选数组,删除那些 nil 值,并使用另一个函数映射非 nil 值。 我知道我可以通过使用 compactMap 然后使用常规 map 来实现这一点,但我只想遍历数组一次。 我为此实现了一
我如何定位 li 元素,除非它们出现在 之后元素?换句话说,我想针对步骤而不是注释。 我尝试向 OL 添加一个我想从选择中排除的类,但我想出的代码不起作用。 (顺便说一句,重构 html 不是一种选
Warning 1 The element 'system.webServer' has invalid child element 'rewrite'. List of possible eleme
我正在尝试编写一个脚本,该脚本将遍历 HTML 源并创建 DOM 的 JSON 文件,然后使用 d3.js 在 TreeView 中显示该文件。我遇到的问题是不仅希望显示元素(TITLE、P、LI 等
我有以下 HTML 表单:- Option 1 Option 2
我试图在选定的 HTML 元素之后选择下一个具有类名 slider-value 的 span 元素。我尝试了多种解决方案,但没有一个有效。 我可以通过 id 选择它,但我不希望那样做使代码冗余。 $(
如果电子邮件地址无效,我想在屏幕上显示一条消息“请输入有效的电子邮件地址”。 body 元素的innerHTML 语句工作正常,但我用于p 元素的innerHTML 语句不起作用。 有一次,当我测试它
以下 jQuery 代码调用 ul 元素,查找元素内的前 三个 li 列表项,并隐藏剩余的 li 项目。然后,它附加一个 li 元素,其中显示“显示更多...”,并且在单击时显示之前隐藏的列表项。 (
我问了a question早些时候关于将编辑/删除链接与 h1 元素内联的最佳方法。我能够通过给出的答案实现这一点,但我现在有额外的要求,我需要在 h1 下方显示一个段落并编辑/删除链接。 到目前为止
我使用 MVC 4 和 knockout.js 库版本 2.1.0 显示从服务器检索到的大量文件的表中的以下摘录。 0)"> 正在正确检索数据,
我创建了一个脚本,该脚本在鼠标悬停在父容器上时激活,并且应该将其子元素移离鼠标。我目前已经让它工作了,但是代码的某些部分似乎与 REACT 代码应该是什么样子相矛盾。特别是两个部分。 我在渲染函数中使
我是 JS 新手,正在尝试理解项目 https://github.com/tastejs/todomvc 的代码 请参阅屏幕截图,我尝试对 button X 以及其父元素 div 设置断点,但在这两种
例如,假设有一个带有奇特颜色的标记: Something written here 使用 Visual Studio 2017 和 MVC 5 元素,有没有办法检查和定位当前应用了哪些样式,以及负责它
我是一名优秀的程序员,十分优秀!