php - 简化 PHP DOM XML 解析—

php - 简化 PHP DOM XML 解析——怎么做？

转载作者：可可西里更新时间：2023-11-01 12:49:30

25

4

我整天都在研究 PHP 的 DOM 函数，但我还不明白它是如何工作的。 :(我有一个简单的 XML 文件，看起来不错，但我无法按照我创建它的结构时的想法使用它。

示例 XML 片段:

-pages //root element
    -page id="1" //we can have any number of pages
        -product id="364826" //we can have any number of products
            -SOME_KIND_OF_VALUE
            -ANOTHER_VALUE
            ...

我最初的想法是加快客户的工作流程，所以我扔掉了旧的 CSV 并开始使用 XML。

问题 1:当我将产品分组到页面时，我使用的是 setIdAttribute以防止在树中多次存储同一页。这在读取发生之前工作正常，因为这些 id 与某种 DTD 相关(基于 getElementById )。

问题 1:我如何编写一个提供这些必要信息的简单 DTD，以便我也可以在读取阶段使用 getElementById？

问题 2:因为我有页面，所以我想加载尽可能少的信息。这就是我在页面上创建 id 属性的原因。现在我无法直接访问我的页面 id="2"，因为上面的问题 1(getElementById 目前没有意义)。我可以通过某种方式设法在给定页面上检索有关每个产品的必要信息，但我的代码看起来很可怕:

$doc      = DOMDocument::load('data.xml');
$xpath    = new DOMXPath($doc);
$query    = '/pages/page[' . $page . ']'; //$page is fine: was set earlier
$products = $xpath->query($query);
$_prods   = $doc->getElementsByTagName('product');
foreach($_prods as $product){
    foreach($product->childNodes as $node){
        echo $node->nodeName . ": " . $node->nodeValue . "<br />";
    }
}

问题 2:我认为上面的代码是关于如何不 解析 XML 的示例。但是由于我对 PHP 的 DOM 函数的了解有限，我不能自己编写一个更干净的函数。我尝试了一些简单的解决方案，但没有一个对我有用。

最佳答案

解决问题 1:

W3C defines : 属性 xml:id 的含义作为 XML 文档中的 ID 属性，并定义了此属性的处理以在没有验证、无需获取外部资源且不依赖于一个内部子集。

换句话说，当你使用

$element->setAttribute('xml:id', 'test');

您不需要调用 setIdAttribute，也不需要指定 DTD 或 Schema。当与 getElementById 一起使用时，DOM 将识别 xml:id 属性，而无需您验证文档或任何其他内容。这是最省力的方法。不过请注意，根据您的操作系统和 libxml 版本，您根本无法使用 getElementById。

解决问题2:

即使无法使用 getElementById 获取 ID，您仍然可以使用 XPath 获取它们:

$xpath->query('/pages/page[@id=1]');

肯定有用。您还可以直接获取特定页面的产品子项:

$xpath->query('//pages/page[@id=1]/products');

除此之外，您几乎无法使 DOM 代码看起来不那么冗长，因为它确实是一个冗长的界面。必须是，因为DOM is a language agnostic interface, again defined by the W3C .

在下方评论后编辑

它像我上面解释的那样工作。这是一个完整的测试用例。第一部分用于编写带有 DOM 的新 XML 文件。这就是您需要设置 xml:id 属性的地方。您可以使用它来代替常规的、非命名空间的 id 属性。

// Setup
$dom = new DOMDocument;
$dom->formatOutput = TRUE;
$dom->preserveWhiteSpace = FALSE;
$dom->loadXML('<pages/>');

// How to set a valid id attribute when not using a DTD or Schema
$page1 = $dom->createElement('page');
$page1->setAttribute('xml:id', 'p1');
$page1->appendChild($dom->createElement('product', 'foo1'));
$page1->appendChild($dom->createElement('product', 'foo2'));

// How to set an ID attribute that requires a DTD or Schema when reloaded
$page2 = $dom->createElement('page');
$page2->setAttribute('id', 'p2');
$page2->setIdAttribute('id', TRUE);
$page2->appendChild($dom->createElement('product', 'bar1'));
$page2->appendChild($dom->createElement('product', 'bar2'));

// Appending pages and saving XML
$dom->documentElement->appendChild($page1);
$dom->documentElement->appendChild($page2);
$xml = $dom->saveXML();
unset($dom, $page1, $page2);
echo $xml;

这将创建一个像这样的 XML 文件:

<?xml version="1.0"?>
<pages>
  <page xml:id="p1">
    <product>foo1</product>
    <product>foo2</product>
  </page>
  <page id="p2">
    <product>bar1</product>
    <product>bar2</product>
  </page>
</pages>

当您再次读取 XML 时，新的 DOM 实例不再知道您已使用 setIdAttribute< 将非命名空间的 id 属性声明为 ID 属性。它仍然在 XML 中，但 id 属性将只是一个常规属性。 You have to be aware that ID attributes are special in XML.

// Load the XML we created above
$dom = new DOMDocument;
$dom->loadXML($xml);

现在进行一些测试:

echo "\n\n GETELEMENTBYID RETURNS ELEMENT WITH XML:ID \n\n";
foreach( $dom->getElementById('p1')->childNodes as $product) {
    echo $product->nodeValue; // Will output foo1 and foo2 with whitespace
}

以上是有效的，因为兼容 DOM 的解析器必须识别 xml:id 是一个 ID 属性，而不管任何 DTD 或 Schema。这在上面链接的规范中有解释。它输出空白的原因是由于格式化输出在开始标签、两个产品标签和结束标签之间存在 DOMText 节点，所以我们迭代五个节点。在使用 XML 时，节点概念对于理解至关重要。

echo "\n\n GETELEMENTBYID CANNOT FETCH NORMAL ID \n\n";
foreach( $dom->getElementById('p2')->childNodes as $product) {
    echo $product->nodeValue; // Will output a NOTICE and a WARNING
}

以上将不起作用，因为 id 不是 ID 属性。要让 DOM 解析器识别它，您需要一个 DTD 或架构，并且必须根据它验证 XML。

echo "\n\n XPATH CAN FETCH NORMAL ID \n\n";
$xPath = new DOMXPath($dom);
$page2 = $xPath->query('/pages/page[@id="p2"]')->item(0);
foreach( $page2->childNodes as $product) {
    echo $product->nodeValue; // Will output bar1 and bar2
}

另一方面，XPath 是有关属性的文字，这意味着如果 getElementById 不可用，您可以查询 DOM 以查找具有属性 id 的页面元素。请注意，要查询 ID 为 p1 的页面，您必须包含 namespace ，例如@xml:id="p1"。

echo "\n\n XPATH CAN FETCH PRODUCTS FOR PAGE WITH ID \n\n";
$xPath = new DOMXPath($dom);
foreach( $xPath->query('/pages/page[@id="p2"]/product') as $product ) {
    echo $product->nodeValue; // Will output bar1 and bar2 w\out whitespace
}

如前所述，您还可以使用 XPath 查询文档中的任何其他内容。这个不会输出空格，因为它只会返回 id p2 页面下面的 product 元素。

您还可以从一个节点遍历整个 DOM。是树状结构。自 DOMNode是 DOM 中最重要的类，您需要熟悉它。

echo "\n\n TRAVERSING UP AND DOWN \n\n";
$product = $dom->getElementsByTagName('product')->item(2);
echo $product->tagName; // 'product'
echo $dom->saveXML($product); // '<product>bar1</product>'

// Going from bar1 to foo1
$product = $product->parentNode // Page Node
                   ->parentNode // Pages Node
                   ->childNodes->item(1)  // Page p1
                   ->childNodes->item(1); // 1st Product

echo $product->nodeValue; // 'foo1'

// from foo1 to foo2 it is two(!) nodes because the XML is formatted
echo $product->nextSibling->nodeName; // '#text' with whitespace and linebreak
echo $product->nextSibling->nextSibling->nodeName; // 'product'
echo $product->nextSibling->nextSibling->nodeValue; // 'foo2'

旁注，是的，我在上面的原始代码中确实有错字。它是 product 而不是 products。但我发现，当您只需更改一个 s 时，声称代码不起作用是没有道理的。这感觉太像想要被喂食了。

关于php - 简化 PHP DOM XML 解析——怎么做？，我们在Stack Overflow上找到一个类似的问题： https://stackoverflow.com/questions/3405117/

25

4

0

文章推荐： php - 用于 Javascript/PHP 开发的最佳编辑器/IDE(?)

文章推荐： html - 字形未加载

文章推荐： php - fatal error : Cannot redeclare mss() (previously declared in *

php - 输出 PHP 分隔符 ()，PHP 不解释分隔符
我在 JavaScript 文件中运行 PHP，例如...... var = '';). 我需要使用 JavaScript 来扫描字符串中的 PHP 定界符(打开和关闭 PHP 的 )。我已经知道使
php - PHP 是否具有确定与给定 PHP 脚本兼容的最旧 PHP 版本的内置方法？还是会永远？
我希望能够做这样的事情: php --determine-oldest-supported-php-version test.php 并得到这个输出: 7.2 也就是说，php 二进制检查 test.
php - 在没有 php 框架的情况下将 php 框架用于现有的 php 应用程序是个好主意吗？
我正在开发一个目前不使用任何框架的大型 php 站点。我的大问题是，随着时间的推移慢慢尝试将框架融入应用程序是否可取，例如在创建的新部件和更新的旧部件中？比如所有的页面都是直接通过url服务的，有几
php - 如何在同一 php 页面上的其他 php 脚本中使用 php 变量
下面是我的源代码，我想在同一页面顶部的另一个 php 脚本中使用位于底部 php 脚本的变量 $r1。我需要一个简单的解决方案来解决这个问题。我想在代码中存在的更新查询中使用该变量。 $name)
php - PHP 重定向后 PHP 是否继续执行？
我正在制作一个网站，根据不同的情况进行大量 PHP 重定向。就像这样...... header("Location: somesite.com/redirectedpage.php"); 为了安全起见
php - 如何避免在 php 文件中写入
我有一个旧网站，我的 php 标签从因为短标签已经显示出安全问题，并且在未来的版本中将不被支持。关于php - 如何避免在 php 文件中写入

php - 需要建议通过 php 编辑 php
我有一个用 PHP 编写的配置文件，如下所示，所以我想用PHP开发一个接口(interface)，它可以编辑文件值，如$WEBPATH , $ACCOUNTPATH和 const值(value)观
php - 无法发布 “PHP file” PHP
我试图制作一个登录页面来学习基本的PHP，首先我希望我的独立PHP文件存储HTML文件的输入(带有表单)，但是当我按下按钮时(触发POST到PHP脚本) )我一直收到令人不愉快的错误。我已经搜索了S
php - PHP 是否有生成有效 PHP 表达式的打印函数？
我正在寻找一种让 PHP 以一种形式打印任意数组的方法，我可以将该数组作为赋值包含在我的(测试)代码中。 print_r 产生例如: Array ( [0] => qsr-part:1285 [1]
php - PHP 数组键有大小限制吗？ PHP 数组一般有哪些限制？
这个问题已经有答案了: 已关闭11 年前。 Possible Duplicate: What is the max key size for an array in PHP? 正如标题所说，我想知道
php - PHP 是否有生成有效 PHP 表达式的打印函数？
我正在寻找一种让 PHP 以一种形式打印任意数组的方法，我可以将该数组作为赋值包含在我的(测试)代码中。 print_r 产生例如: Array ( [0] => qsr-part:1285 [1]
php - 让函数在 php 刷新时执行 (PHP)
关闭。这个问题需要多问focused 。目前不接受答案。想要改进此问题吗？更新问题，使其仅关注一个问题 editing this post . 已关闭 9 年前。 Improve this ques
php - 按时间段显示菜单 PHP PHP MySQL
我在 MySQL 数据库中有一个表，其中存储餐厅在每个工作日和时段提供的菜单。表结构如下: i_type i_name i_cost i_day i_start i_
php - 将参数发送到嵌套在 PHP 页面内的动态 PHP
我有两页。 test1.php 和 test2.php。我想做的就是在 test1.php 上点击提交，并将 test2.php 显示在 div 中。这实际上工作正常，但我需要向 test2.php
php - 文本区域 -> php -> mysql -> php
我得到了这个代码。我想通过textarea更新mysql。我在textarea中回显我的MySQL，但我不知道如何更新它，我应该把所有东西都放进去吗，因为_GET模式没有给我任何东西，我也尝试_GET
php - 我如何将一个 php 的值解析为另一个 php
首先，我是 php 的新手，所以我仍在努力学习。我在 Wordpress 上创建了一个表单，我想将值插入一个表(data_test 表，我已经管理了)，然后从 data_test 表中获取所有列(id
php - php 中的安全首选项、php 函数来清理输入
我有以下函数可以清理用户或网址的输入: function SanitizeString($var) { $var=stripslashes($var); $va
php - HTML/PHP 登录重定向到 php
我有一个 html 页面，它使用 php 文件查询数据库，然后让用户登录，否则拒绝访问。我遇到的问题是它只是重定向到 php 文件的 url，并且从不对发生的事情提供反馈。这是我第一次使用 html、
php - onClick php PHP 函数然后重定向
我有一个页面充满了指向 pdf 的链接，我想跟踪哪些链接被单击。我以为我可以做如下的事情，但遇到了问题: query($sql); if($result){
php - 有没有办法从 PHP 代码加载的文件中解析 PHP？
我正在使用从外部文本文件加载 HTML/PHP 代码 $f = fopen($filename, "r"); while ($line = fgets($f, 4096)) { print $l

首页

博学

6Ren·AI

商城

php - 简化 PHP DOM XML 解析——怎么做？