使用preg_match_all提取XML中PIC节点图片URL无结果如何解决
问题排查及修正方案
原代码存在的核心问题
xpath()返回的是SimpleXMLElement对象数组,不能直接传入preg_match_all作为匹配目标,需要逐个提取每个PICTURE节点下PIC字段的文本内容再做正则匹配- 正则表达式规则错误:
- 未匹配
SRC后的双引号,实际内容格式为SRC="https://xxx",规则里漏了引号匹配 - 未使用非贪婪匹配,
.*贪婪模式会匹配到最后一个width,可能出现跨内容匹配问题
- 未匹配
preg_match_all的返回结果结构使用错误:捕获到的URL内容存放在结果数组的下标1位置,不能直接遍历整个结果数组- 遍历匹配结果时错误使用对象属性调用
$PICelements->PIC,正则匹配得到的是字符串,不存在该对象属性
修正后的代码
public function xmlParserPICtn(): string { $display = ''; // 查询所有符合条件的PICTURE节点 $pictures = $this->xml->xpath("//OBJEKT[@ID='91727']//PICTURE"); // 修正后的正则:匹配SRC="和"之间的内容,非贪婪模式,忽略大小写兼容不同写法 $pattern = '/SRC="(.*?)"/i'; foreach ($pictures as $picNode) { // 强转提取PIC节点的文本内容 $picContent = (string)$picNode->PIC; if (preg_match($pattern, $picContent, $matches)) { $url = $matches[1]; $display .= "<li>{$url}</li>"; } } return $display; }
补充说明
如果需要一次性匹配所有URL,也可以先把所有PIC的文本内容拼接后再用preg_match_all批量提取,再遍历输出即可,效果和上述逐节点匹配一致。
内容的提问来源于stack exchange,提问作者bruno2000
相关产品推荐
相关产品推荐

