如何映射XML文件中的注释或处理指令？

幻夢星雲

发布时间：2026-01-19 11:11:02

505人浏览过

来源于php中文网

原创

主流XML解析器默认忽略注释和处理指令，需显式启用保留模式：ElementTree需自定义TreeBuilder，lxml支持parse_comments=True，DOM需设置domConfig参数。

如何映射xml文件中的注释或处理指令？

XML解析器默认忽略注释和处理指令

绝大多数主流XML解析器（如Python的xml.etree.ElementTree、Java的DOMParser、JavaScript的DOMParser）在构建文档树时，会直接跳过和节点。这不是bug，而是W3C规范允许的“非信息项”处理策略——除非显式启用保留模式，否则它们不会出现在childNodes或iter()结果中。

ElementTree需用`XMLParser(target=)`捕获注释

Python标准库的ElementTree不提供开箱即用的注释访问接口，但可通过自定义TreeBuilder配合XMLParser实现。关键在于重写comment()和pi()方法：

from xml.etree import ElementTree as ET
from xml.etree.ElementTree import TreeBuilder
class CommentPreservingBuilder(TreeBuilder):
def comment(self, data):
self.start(ET.Comment, {})
self.data(data)
self.end(ET.Comment)
def pi(self, target, data):
    self.start(ET.PI, {'target': target, 'data': data})
    self.end(ET.PI)
parser = ET.XMLParser(target=CommentPreservingBuilder())
root = ET.parse("doc.xml", parser).getroot()
注释节点现在是真实元素，可用findall查找
comments = root.findall(".//{*}comment")  # 注意命名空间通配


ET.Comment和ET.PI是特殊节点类型，不能用字符串标签名直接匹配
必须用.//{*}comment这种带通配命名空间的XPath，否则findall("comment")找不到
注释内容通过node.text获取，而非node.attrib


lxml支持parse_comments=True一键开启
如果你能引入第三方库，lxml是最省心的选择。它原生支持注释和PI节点保留，并提供清晰的API：

							
								
								
									Manus
									全球首款通用型AI Agent，可以将你的想法转化为行动。
								
								下载 
							
						
from lxml import etree
parser = etree.XMLParser(remove_comments=False, recover=True)
tree = etree.parse("doc.xml", parser)
root = tree.getroot()
直接遍历所有节点，包括注释
for node in root.iter():
if isinstance(node, etree._Comment):
print("Comment:", node.text.strip())
elif isinstance(node, etree._ProcessingInstruction):
print("PI:", node.target, node.text)


remove_comments=False是必须参数，缺省为True


etree._Comment和etree._ProcessingInstruction是具体类型，不能用字符串判断
注意recover=True可容忍部分格式错误，避免解析中断

DOM解析中需手动设置domConfig特性
浏览器环境或Java DOM中，注释节点默认存在但可能被过滤。必须显式启用"comments"和"CDATA-sections"特性：
// JavaScript示例（浏览器环境）
const parser = new DOMParser();
const doc = parser.parseFromString(xmlString, "application/xml");
// 启用注释保留（部分浏览器需此步）
doc.domConfig?.setParameter("comments", true);
doc.domConfig?.setParameter("CDATA-sections", true);
// 现在可以安全遍历
Array.from(doc.childNodes).forEach(node => {
if (node.nodeType === Node.COMMENT_NODE) {
console.log("Comment:", node.textContent);
}
});

现代Chrome/Firefox通常默认保留注释，但Safari和旧版IE可能需要domConfig


Node.COMMENT_NODE值为8，Node.PROCESSING_INSTRUCTION_NODE为7

服务端DOM（如JAXP）必须调用setFeature("http://apache.org/xml/features/dom/include-comments", true)


注释和处理指令的映射不是“有没有”的问题，而是“要不要主动打开开关”的问题。不同解析器的默认行为差异极大，最容易踩的坑是：以为iter()或childNodes天然包含它们，结果调试半天发现根本没进循环。

JavaScript怎么处理XML JS解析和遍历XML节点教程

JavaScript怎么把JSON数据转换成XML字符串

JavaScript如何处理XML数据 JS解析XML字符串教程

JavaScript怎么在Web Worker中解析XML

JavaScript怎么在浏览器端验证XML

本站声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

上一篇：REST API返回XML还是JSON更好下一篇：暂无

作者最新文章

抖音怎么设置私密账号_抖音隐藏作品不让别人看的方法

2026-01-19 08:15

电脑蓝牙已配对但无法连接是怎么回事设备删除重新配对方法

2026-01-19 08:17

冬天身上静电太多被电怎么办？教你几招彻底消除静电困扰【防电小妙招】

2026-01-19 08:55

Word为什么不能复制_Word软件无法执行复制操作详解

2026-01-19 09:16

正则表达式主要包括_正则表达式核心语法成分构成

2026-01-19 09:18

EndeavourOS怎么安装体验终端 centric的Arch Linux【美观】

2026-01-19 09:23

电脑麦克风没有声音怎么办解决语音聊天没声音的方法【一键搞定】

2026-01-19 09:32

怎么在不重装系统的情况下更改计算机名和工作组【网络设置】

2026-01-19 09:32

Rufus怎么用 Rufus制作系统U盘启动盘教程

2026-01-19 10:08

c# HttpCompletionOption.ResponseHeadersRead 在高并发下载中的应用

2026-01-19 10:18

热门AI工具

DeepSeek

幻方量化公司旗下的开源大模型平台

AI大模型

开放平台

豆包大模型

字节跳动自主研发的一系列大型语言模型

AI大模型

通义千问

阿里巴巴推出的全能AI助手

AI大模型

腾讯元宝

腾讯混元平台推出的AI助手

文档处理

Excel 表格

文心一言

文心一言是百度开发的AI聊天机器人，通过对话可以生成各种形式的内容。

AI大模型

中文写作

讯飞写作

基于讯飞星火大模型的AI写作工具，可以快速生成新闻稿件、品宣文案、工作总结、心得体会等各种文文稿

中文写作

写作工具

即梦AI

一站式AI创作平台，免费AI图片和视频生成。

图片拼接

图画生成

ChatGPT

最最强大的AI聊天机器人程序，ChatGPT不单是聊天机器人，还能进行撰写邮件、视频脚本、文案、翻译、代码等任务。

AI大模型

中文写作

智谱清言 - 免费全能的AI助手

AI大模型

PDF 文档

相关专题

python开发工具

php中文网为大家提供各种python开发工具，好的开发工具，可帮助开发者攻克编程学习中的基础障碍，理解每一行源代码在程序执行时在计算机中的过程。php中文网还为大家带来python相关课程以及相关文章等内容，供大家免费下载使用。

760

2023.06.15

python打包成可执行文件

本专题为大家带来python打包成可执行文件相关的文章，大家可以免费的下载体验。

639

2023.07.20

python能做什么

python能做的有：可用于开发基于控制台的应用程序、多媒体部分开发、用于开发基于Web的应用程序、使用python处理数据、系统编程等等。本专题为大家提供python相关的各种文章、以及下载和课程。

762

2023.07.25

format在python中的用法

Python中的format是一种字符串格式化方法，用于将变量或值插入到字符串中的占位符位置。通过format方法，我们可以动态地构建字符串，使其包含不同值。php中文网给大家带来了相关的教程以及文章，欢迎大家前来阅读学习。

619

2023.07.31

python教程

Python已成为一门网红语言，即使是在非编程开发者当中，也掀起了一股学习的热潮。本专题为大家带来python教程的相关文章，大家可以免费体验学习。

1285

2023.08.03

python环境变量的配置

Python是一种流行的编程语言，被广泛用于软件开发、数据分析和科学计算等领域。在安装Python之后，我们需要配置环境变量，以便在任何位置都能够访问Python的可执行文件。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

549

2023.08.04

python eval

eval函数是Python中一个非常强大的函数，它可以将字符串作为Python代码进行执行，实现动态编程的效果。然而，由于其潜在的安全风险和性能问题，需要谨慎使用。php中文网给大家带来了相关的教程以及文章，欢迎大家前来学习阅读。

579

2023.08.04

scratch和python区别

scratch和python的区别：1、scratch是一种专为初学者设计的图形化编程语言，python是一种文本编程语言；2、scratch使用的是基于积木的编程语法，python采用更加传统的文本编程语法等等。本专题为大家提供scratch和python相关的文章、下载、课程内容，供大家免费下载体验。

709

2023.08.11

PHP WebSocket 实时通信开发

本专题系统讲解 PHP 在实时通信与长连接场景中的应用实践，涵盖 WebSocket 协议原理、服务端连接管理、消息推送机制、心跳检测、断线重连以及与前端的实时交互实现。通过聊天系统、实时通知等案例，帮助开发者掌握使用 PHP 构建实时通信与推送服务的完整开发流程，适用于即时消息与高互动性应用场景。

2026.01.19

热门下载

网站特效

网站源码

网站素材

前端模板