XML文档类型定义(DTD)

2023-11-29 01:58
文章标签 xml 文档 类型定义 dtd

本文主要是介绍XML文档类型定义(DTD),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

1、格式良好的 XML文档
符合语法的XML文档称为结构良好的XML文档 。

2、有效XML文档
有效XML文档:内容结构严格遵守它自身的标记说明,能通过自身的语法检查;通过DTD验证的XML文档称为有效的XML文档 。

格式良好的XML文档与有效的XML文档的区别?

有效地XML文档肯定是格式良好的XML文档。反过来,一个格式良好的XML文档不一定是有效的XML文档。有效的XML文档遵守DTD或Schema定义的规则。

3、文档类型定义(Document Type Definition,DTD)是关于文档中所用到标记符的语法规则。
4、一个DTD文档包含:

元素(ELEMENT)的定义规则

元素之间的关系规则

属性(ATTLIST)的定义规则

可使用的实体(ENTITY)或符号(NOTATION)规则

5、DTD与XML文档实例的关系

类与对象

数据库表结构与数据记录

6、DTD的基本结构

DTD的基本结构包括XML声明、元素(ELEMENT)声明和属性列表(ATTLIST)声明等。

7、定义元素及其后代

定义元素即对XML文档中所使用元素及其使用方法的定义。定义包括元素名称和构成元素的基本类型两部分,构成元素的基本类型包括简单类型和复合类型两种。

简单的类型:

<!ELEMENT 名称 (#PCDATA)>

符合类型:

<!ELEMENT 我的电脑 (CPU, 内存+, 硬盘+)>

8、元素的定义

元素类型声明的基本格式:

   <!ELEMENT  元素名  元素内容模式>

元素内容模式

•空模式

元素不能包含任何子元素,也不能包含任何数据内容。

语法:<!ELEMENT 元素名 EMPTY>

例DTD定义如下:

<!ELEMENT person EMPTY>

•任意模式

元素可以包含任何子元素或数据

语法:

  <!ELEMENT 元素名 ANY>

•#PCDATA模式

声明为#PCDATA类型的元素是不包含任何其他元素而只包含字符数据即文本数据的元素;

一般语法结构为:
<!ELEMENT 元素名   (#PCDATA)>

#PCDATA示例

  <!ELEMENT title  (#PCDATA)>

对应的XML元素:
<title>元素的数据内容</title>

  <title></title>

•子元素模式

子元素定义集模式用来说明那些有严格层次结构包含关系的元素。利用子元素定义集模式可以说明某元素必须包含哪些子元素及其相互位置、层次关系。

有3种形式:

•逗号[子元素之间有严格的先后顺序]
•竖线[必须任选其一]
•逗号与竖线可以混合使用

例如:

<!ELEMENT 我的电脑 (CPU, 内存, 硬盘)>

<!ELEMENT CPU (AMD | Intel )>

<!ELEMENT GREETINGS  ((SEASON|NAME),POSTFIX)>

9、元素指示符

?修饰符:说明它所修饰的子元素组合可以出现零次或一次,即这种组合可以出现,也可以不出现。

+修饰符:说明它所修饰的子元素组合可以出现一次或一次以上的任意多次,即+修饰符所修饰的子元素组合至少必须出现一次。

*修饰符:说明它所修饰的子元素组合可以出现零次到任意多次,即*修饰符所修饰的子元素组合可以出现,也可以不出现,可以出现一次,也可以出现多次。

<!ELEMENT 我的电脑 (CPU, 内存+, 硬盘+,音响?,描述*)>

10定义元素属性

DTD中的属性声明用来定义所有元素可接受的属性。

在DTD声明元素的同时,还可以指定元素具有的属性。DTD中的属性声明不仅约束了XML文档中元素的属性名,还约束了元素的取值类型。

属性定义的一般语法:

<!ATTLIST 元素名 属性名1  属性1类型   缺省的属性1取值

           属性名2  属性2类型   缺省的属性2取值

                               属性名3  属性3类型   缺省的属性3取值

>

元素属性的声明顺序不对XML文档构成限制,但为了便于理解和后期维护,这里建议在XML文档中的属性顺序应按照其引用的DTD中的声明顺序来排列。

11、预定义属性值

元素某属性可能是在XML文档定义时必须单独填写的,也可以是可有可无的,还可能要求必须使用某一个指定的值。这些要求决定了DTD必须分别对待不同情况。#REQUIRED、#IMPLIED、#FIXED三个关键词与上诉三种情况分别对应。

#REQUIRED

属性不能忽略,必须在元素的属性列表中出现

#IMPLIED

可选属性,可以不在元素的属性列表中出现

#FIXED

可选属性,如出现此属性,则其取值必须是固定的属性值。如忽略此属性,在验证文档后,元素将隐含此属性,其取值为固定的属性值

这篇关于XML文档类型定义(DTD)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/431034

相关文章

Python操作PDF文档的主流库使用指南

《Python操作PDF文档的主流库使用指南》PDF因其跨平台、格式固定的特性成为文档交换的标准,然而,由于其复杂的内部结构,程序化操作PDF一直是个挑战,本文主要为大家整理了Python操作PD... 目录一、 基础操作1.PyPDF2 (及其继任者 pypdf)2.PyMuPDF / fitz3.Fre

springboot自定义注解RateLimiter限流注解技术文档详解

《springboot自定义注解RateLimiter限流注解技术文档详解》文章介绍了限流技术的概念、作用及实现方式,通过SpringAOP拦截方法、缓存存储计数器,结合注解、枚举、异常类等核心组件,... 目录什么是限流系统架构核心组件详解1. 限流注解 (@RateLimiter)2. 限流类型枚举 (

C#监听txt文档获取新数据方式

《C#监听txt文档获取新数据方式》文章介绍通过监听txt文件获取最新数据,并实现开机自启动、禁用窗口关闭按钮、阻止Ctrl+C中断及防止程序退出等功能,代码整合于主函数中,供参考学习... 目录前言一、监听txt文档增加数据二、其他功能1. 设置开机自启动2. 禁止控制台窗口关闭按钮3. 阻止Ctrl +

Java docx4j高效处理Word文档的实战指南

《Javadocx4j高效处理Word文档的实战指南》对于需要在Java应用程序中生成、修改或处理Word文档的开发者来说,docx4j是一个强大而专业的选择,下面我们就来看看docx4j的具体使用... 目录引言一、环境准备与基础配置1.1 Maven依赖配置1.2 初始化测试类二、增强版文档操作示例2.

Java操作Word文档的全面指南

《Java操作Word文档的全面指南》在Java开发中,操作Word文档是常见的业务需求,广泛应用于合同生成、报表输出、通知发布、法律文书生成、病历模板填写等场景,本文将全面介绍Java操作Word文... 目录简介段落页头与页脚页码表格图片批注文本框目录图表简介Word编程最重要的类是org.apach

python删除xml中的w:ascii属性的步骤

《python删除xml中的w:ascii属性的步骤》使用xml.etree.ElementTree删除WordXML中w:ascii属性,需注册命名空间并定位rFonts元素,通过del操作删除属... 可以使用python的XML.etree.ElementTree模块通过以下步骤删除XML中的w:as

XML重复查询一条Sql语句的解决方法

《XML重复查询一条Sql语句的解决方法》文章分析了XML重复查询与日志失效问题,指出因DTO缺少@Data注解导致日志无法格式化、空指针风险及参数穿透,进而引发性能灾难,解决方案为在Controll... 目录一、核心问题:从SQL重复执行到日志失效二、根因剖析:DTO断裂引发的级联故障三、解决方案:修复

Python Pillow 库详解文档(最新推荐)

《PythonPillow库详解文档(最新推荐)》Pillow是Python中最流行的图像处理库,它是PythonImagingLibrary(PIL)的现代分支和继承者,本文给大家介绍Pytho... 目录python Pillow 库详解文档简介安装核心模块架构Image 模块 - 核心图像处理基本导入

SpringBoot项目配置logback-spring.xml屏蔽特定路径的日志

《SpringBoot项目配置logback-spring.xml屏蔽特定路径的日志》在SpringBoot项目中,使用logback-spring.xml配置屏蔽特定路径的日志有两种常用方式,文中的... 目录方案一:基础配置(直接关闭目标路径日志)方案二:结合 Spring Profile 按环境屏蔽关

C#实现将Office文档(Word/Excel/PDF/PPT)转为Markdown格式

《C#实现将Office文档(Word/Excel/PDF/PPT)转为Markdown格式》Markdown凭借简洁的语法、优良的可读性,以及对版本控制系统的高度兼容性,逐渐成为最受欢迎的文档格式... 目录为什么要将文档转换为 Markdown 格式使用工具将 Word 文档转换为 Markdown(.