XML文档类型定义(DTD)

2023-11-29 01:58
文章标签 xml 文档 类型定义 dtd

本文主要是介绍XML文档类型定义(DTD),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

1、格式良好的 XML文档
符合语法的XML文档称为结构良好的XML文档 。

2、有效XML文档
有效XML文档:内容结构严格遵守它自身的标记说明,能通过自身的语法检查;通过DTD验证的XML文档称为有效的XML文档 。

格式良好的XML文档与有效的XML文档的区别?

有效地XML文档肯定是格式良好的XML文档。反过来,一个格式良好的XML文档不一定是有效的XML文档。有效的XML文档遵守DTD或Schema定义的规则。

3、文档类型定义(Document Type Definition,DTD)是关于文档中所用到标记符的语法规则。
4、一个DTD文档包含:

元素(ELEMENT)的定义规则

元素之间的关系规则

属性(ATTLIST)的定义规则

可使用的实体(ENTITY)或符号(NOTATION)规则

5、DTD与XML文档实例的关系

类与对象

数据库表结构与数据记录

6、DTD的基本结构

DTD的基本结构包括XML声明、元素(ELEMENT)声明和属性列表(ATTLIST)声明等。

7、定义元素及其后代

定义元素即对XML文档中所使用元素及其使用方法的定义。定义包括元素名称和构成元素的基本类型两部分,构成元素的基本类型包括简单类型和复合类型两种。

简单的类型:

<!ELEMENT 名称 (#PCDATA)>

符合类型:

<!ELEMENT 我的电脑 (CPU, 内存+, 硬盘+)>

8、元素的定义

元素类型声明的基本格式:

   <!ELEMENT  元素名  元素内容模式>

元素内容模式

•空模式

元素不能包含任何子元素,也不能包含任何数据内容。

语法:<!ELEMENT 元素名 EMPTY>

例DTD定义如下:

<!ELEMENT person EMPTY>

•任意模式

元素可以包含任何子元素或数据

语法:

  <!ELEMENT 元素名 ANY>

•#PCDATA模式

声明为#PCDATA类型的元素是不包含任何其他元素而只包含字符数据即文本数据的元素;

一般语法结构为:
<!ELEMENT 元素名   (#PCDATA)>

#PCDATA示例

  <!ELEMENT title  (#PCDATA)>

对应的XML元素:
<title>元素的数据内容</title>

  <title></title>

•子元素模式

子元素定义集模式用来说明那些有严格层次结构包含关系的元素。利用子元素定义集模式可以说明某元素必须包含哪些子元素及其相互位置、层次关系。

有3种形式:

•逗号[子元素之间有严格的先后顺序]
•竖线[必须任选其一]
•逗号与竖线可以混合使用

例如:

<!ELEMENT 我的电脑 (CPU, 内存, 硬盘)>

<!ELEMENT CPU (AMD | Intel )>

<!ELEMENT GREETINGS  ((SEASON|NAME),POSTFIX)>

9、元素指示符

?修饰符:说明它所修饰的子元素组合可以出现零次或一次,即这种组合可以出现,也可以不出现。

+修饰符:说明它所修饰的子元素组合可以出现一次或一次以上的任意多次,即+修饰符所修饰的子元素组合至少必须出现一次。

*修饰符:说明它所修饰的子元素组合可以出现零次到任意多次,即*修饰符所修饰的子元素组合可以出现,也可以不出现,可以出现一次,也可以出现多次。

<!ELEMENT 我的电脑 (CPU, 内存+, 硬盘+,音响?,描述*)>

10定义元素属性

DTD中的属性声明用来定义所有元素可接受的属性。

在DTD声明元素的同时,还可以指定元素具有的属性。DTD中的属性声明不仅约束了XML文档中元素的属性名,还约束了元素的取值类型。

属性定义的一般语法:

<!ATTLIST 元素名 属性名1  属性1类型   缺省的属性1取值

           属性名2  属性2类型   缺省的属性2取值

                               属性名3  属性3类型   缺省的属性3取值

>

元素属性的声明顺序不对XML文档构成限制,但为了便于理解和后期维护,这里建议在XML文档中的属性顺序应按照其引用的DTD中的声明顺序来排列。

11、预定义属性值

元素某属性可能是在XML文档定义时必须单独填写的,也可以是可有可无的,还可能要求必须使用某一个指定的值。这些要求决定了DTD必须分别对待不同情况。#REQUIRED、#IMPLIED、#FIXED三个关键词与上诉三种情况分别对应。

#REQUIRED

属性不能忽略,必须在元素的属性列表中出现

#IMPLIED

可选属性,可以不在元素的属性列表中出现

#FIXED

可选属性,如出现此属性,则其取值必须是固定的属性值。如忽略此属性,在验证文档后,元素将隐含此属性,其取值为固定的属性值

这篇关于XML文档类型定义(DTD)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/431034

相关文章

Python利用ElementTree实现快速解析XML文件

《Python利用ElementTree实现快速解析XML文件》ElementTree是Python标准库的一部分,而且是Python标准库中用于解析和操作XML数据的模块,下面小编就来和大家详细讲讲... 目录一、XML文件解析到底有多重要二、ElementTree快速入门1. 加载XML的两种方式2.

使用Python从PPT文档中提取图片和图片信息(如坐标、宽度和高度等)

《使用Python从PPT文档中提取图片和图片信息(如坐标、宽度和高度等)》PPT是一种高效的信息展示工具,广泛应用于教育、商务和设计等多个领域,PPT文档中常常包含丰富的图片内容,这些图片不仅提升了... 目录一、引言二、环境与工具三、python 提取PPT背景图片3.1 提取幻灯片背景图片3.2 提取

Android实现在线预览office文档的示例详解

《Android实现在线预览office文档的示例详解》在移动端展示在线Office文档(如Word、Excel、PPT)是一项常见需求,这篇文章为大家重点介绍了两种方案的实现方法,希望对大家有一定的... 目录一、项目概述二、相关技术知识三、实现思路3.1 方案一:WebView + Office Onl

Spring 基于XML配置 bean管理 Bean-IOC的方法

《Spring基于XML配置bean管理Bean-IOC的方法》:本文主要介绍Spring基于XML配置bean管理Bean-IOC的方法,本文给大家介绍的非常详细,对大家的学习或工作具有一... 目录一. spring学习的核心内容二. 基于 XML 配置 bean1. 通过类型来获取 bean2. 通过

Python实现word文档内容智能提取以及合成

《Python实现word文档内容智能提取以及合成》这篇文章主要为大家详细介绍了如何使用Python实现从10个左右的docx文档中抽取内容,再调整语言风格后生成新的文档,感兴趣的小伙伴可以了解一下... 目录核心思路技术路径实现步骤阶段一:准备工作阶段二:内容提取 (python 脚本)阶段三:语言风格调

使用Java将DOCX文档解析为Markdown文档的代码实现

《使用Java将DOCX文档解析为Markdown文档的代码实现》在现代文档处理中,Markdown(MD)因其简洁的语法和良好的可读性,逐渐成为开发者、技术写作者和内容创作者的首选格式,然而,许多文... 目录引言1. 工具和库介绍2. 安装依赖库3. 使用Apache POI解析DOCX文档4. 将解析

使用Python将JSON,XML和YAML数据写入Excel文件

《使用Python将JSON,XML和YAML数据写入Excel文件》JSON、XML和YAML作为主流结构化数据格式,因其层次化表达能力和跨平台兼容性,已成为系统间数据交换的通用载体,本文将介绍如何... 目录如何使用python写入数据到Excel工作表用Python导入jsON数据到Excel工作表用

Java利用docx4j+Freemarker生成word文档

《Java利用docx4j+Freemarker生成word文档》这篇文章主要为大家详细介绍了Java如何利用docx4j+Freemarker生成word文档,文中的示例代码讲解详细,感兴趣的小伙伴... 目录技术方案maven依赖创建模板文件实现代码技术方案Java 1.8 + docx4j + Fr

使用C#代码在PDF文档中添加、删除和替换图片

《使用C#代码在PDF文档中添加、删除和替换图片》在当今数字化文档处理场景中,动态操作PDF文档中的图像已成为企业级应用开发的核心需求之一,本文将介绍如何在.NET平台使用C#代码在PDF文档中添加、... 目录引言用C#添加图片到PDF文档用C#删除PDF文档中的图片用C#替换PDF文档中的图片引言在当

详解C#如何提取PDF文档中的图片

《详解C#如何提取PDF文档中的图片》提取图片可以将这些图像资源进行单独保存,方便后续在不同的项目中使用,下面我们就来看看如何使用C#通过代码从PDF文档中提取图片吧... 当 PDF 文件中包含有价值的图片,如艺术画作、设计素材、报告图表等,提取图片可以将这些图像资源进行单独保存,方便后续在不同的项目中使