- html - 出于某种原因,IE8 对我的 Sass 文件中继承的 html5 CSS 不友好?
- JMeter 在响应断言中使用 span 标签的问题
- html - 在 :hover and :active? 上具有不同效果的 CSS 动画
- html - 相对于居中的 html 内容固定的 CSS 重复背景?
我有一个网上商店,在搜索某种项目后,我需要从该网上商店获取一组具有特定参数(如名称、价格、描述等)的产品。通过输入关键字进行搜索。这是一个网站:https://www.aboutyou.de/dein-shop 。这是我试图解析的搜索:https://www.aboutyou.de/frauen/accessoires/huete-und-muetzen/caps?pl=1
因此,考虑到页面的 html 源中存在复杂的标签层次结构,我需要获取所有这些数据。我尝试按类获取元素,但最高的元素除外,它由 id 标记并由正文包裹。所以我尝试使用 jsoup 做这样的事情:
lements resultt = doc.body().select("main#app");
for(Element el : resultt){
Elements main = el.getElementsByClass("section.layout_11glwo1-o_O-stretchLayout_1jug6qr > " +
"div.content_1jug6qr > " +
"div.container > " +
"div.mainContent_10ejhcu > " +
"div.productStream_6k751k > " +
"div > " +
"div.wrapper_8yay2a > " +
"div.col-sm-6.col-md-4 > " +
"div.wrapper_1eu800j > " +
"div > " +
"div.categoryTileWrapper_e296pg > " +
"a.anchor_wgmchy > " +
"div.details_197iil9 > " +
"div.meta_1ihynio > " +
"div.finalPrice_11ythok > " +
"span.price_1543wg1");
System.out.println("just print it" + main.text());
}
但是在“just print it”短语之后什么也没有打印。我知道这不是配置问题,因为我使用更高级别的标签将一些信息与 gem 绑定(bind)在一起。我可以在代码中更改什么来获取该产品实体信息?我是 jsoup 新手,因此我将不胜感激任何帮助!
最佳答案
如果将 Elements main = el.getElementsByClass("section.layout_11glwo1-o_O-stretchLayout_1jug6qr >...
替换为 el.select
,您将获得所有价格的列表:
17,90€ 19,90€ 19,90€ 24,90€ 19,90€ 24,90€ 24,90€ 19,90€ 17,90€ 19,90€ 17,90€ 49,90€ 39,90€ 39,90€ 17,90€ 19,99€ 39,90€ 19,99€ 34,95€ 17,90€
这可能是因为选择器不是类选择器。
编辑这是适合我的完整代码 -
Document doc = Jsoup.connect("https://www.aboutyou.de/frauen/accessoires/huete-und-muetzen/caps?pl=1")
.userAgent("Mozilla/5.0 (Windows NT 6.1; Win64; x64; rv:57.0) Gecko/20100101 Firefox/57.0")
.get();
Elements result = doc.body().select("main#app");
for(Element el : result) {
Elements e = el.select("section.layout_11glwo1-o_O-stretchLayout_1jug6qr > " +
"div.content_1jug6qr > " +
"div.container > " +
"div.mainContent_10ejhcu > " +
"div.productStream_6k751k > " +
"div > " +
"div.wrapper_8yay2a > " +
"div.col-sm-6.col-md-4 > " +
"div.wrapper_1eu800j > " +
"div > " +
"div.categoryTileWrapper_e296pg > " +
"a.anchor_wgmchy > " +
"div.details_197iil9 > " +
"div.meta_1ihynio > " +
"div.finalPrice_11ythok > " +
"span.price_1543wg1");
System.out.println(e.text());
}
关于java - getElementByClass Jsoup 没有打印任何内容,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/47947880/
我想知道在这种情况下错误处理是如何工作的。我正在抓取一页 10 件商品的价格。如果 1 件商品售完,价格就会消失。刮板会中断,因为它正在寻找不在这里的类,因此它需要一个错误处理程序来打印“错误,已售完
已关闭。此问题不符合Stack Overflow guidelines 。目前不接受答案。 有关您编写的代码问题的问题必须在问题本身中描述具体问题 - 并包含有效代码以重现该问题。请参阅SSCCE.o
我试图编写一个小型库存类型的代码。 var dragIcon = document.getElementByClass('hover-div').createElement('img'); 所
我有一个页面,其中有一些链接,我希望能够使用两个按钮进行切换。它使用 getElementById 与一个链接配合使用,但我需要切换其中的几组。我从这个开始,但没有成功。我听说 getElementB
我有一个网上商店,在搜索某种项目后,我需要从该网上商店获取一组具有特定参数(如名称、价格、描述等)的产品。通过输入关键字进行搜索。这是一个网站:https://www.aboutyou.de/dein
这个问题已经有答案了: What do querySelectorAll and getElementsBy* methods return? (12 个回答) 已关闭 6 年前。 这里我尝试调用类并
为什么我写 document.getElementByClass('home1').setAttribute('style', 'background-image:url(img/red_menu.P
为什么我写 document.getElementByClass('home1').setAttribute('style', 'background-image:url(img/red_menu.P
我一直在尝试使用此代码在 html/ajax 中按类读取元素,因为我知道 GetElementByClass 不是 webBrowser.Document 中的一个选项。我似乎无法获得返回值然后调用该
我正在尝试使用 class="stopMusic" 运行任何按钮的函数 onclick。我在 Firebug 中遇到错误 document.getElementByClass is not a fun
我有 8 divs带有 id="div1","div2","div3".... 和 class=divs。我还有一个button与class =“div1”,“div2”,“div3”......。
像 getElementById 这样跨浏览器使用 getElementByClass 是否安全? 更新当前使用: window.opener.document.getElementById 但我想
这个问题在这里已经有了答案: What do querySelectorAll and getElementsBy* methods return? (12 个答案) 关闭 4 年前。 我对我不理解
Render this text using the myC class --------------------------- .teststyle { background-c
我的文档正文中有以下 DOM 结构: 我在尝试更新 class='Main' 的 HTML 时遇到了困难。我正在使用的代码是 var selector = document.getEleme
我是一名优秀的程序员,十分优秀!