当前位置:文档之家› 统一制定统计元数据标准

统一制定统计元数据标准

统一制定统计元数据标准
统一制定统计元数据标准

企业一套表主要元数据标准

一、统计元数据概念及标准

元数据是定义和描述其他数据的数据。元数据标准是描述某类资源的具体对象时所有规则的集合,一般包括完整描述一个具体对象所需要的数据项集合、各数据项语义定义、著录规则和计算机应用时的语法规定等。

元数据概念应用于统计数据生产和管理等业务流程,形成统计制度、统计报表、统计指标、统计分组和统计目录等统计元数据,用来定义、描述和解释统计生产过程中产生的各类实体统计数据。统计元数据标准是对实体数据的实质、内容、状态、范围、质量、表示方式、来源、计算方法、空间参考、时间参考、管理方式以及其他特征等描述数据所需的基本要素进行统一的规范和定义。

二、制定统计元数据标准的意义

参照国内和国际相关标准,研究制定统一规范的统计元数据标准,通过现代信息技术,实现统计元数据的规范化和标准化管理,有助于对统计数据的一致性理解,为统计数据和元数据的高效共享和交换提供基础。

160

企业一套表的实施涉及到统计设计管理、数据采集处理和分析评估各环节。配合企业一套表的全面实施,首先研究制定与企业一套表密切相关的主要元数据标准,可以为企业一套表统计业务流程重构、数据采集处理平台开发以及数据交换和共享提供统一的标准和规范。元数据标准在企业一套表中的应用,能够规范统一指标的名称、涵义、计算方法和代码,强化统计分类标准在统计调查中的执行。在此基础上,逐步完善研究制定涵盖统计设计管理、数据采集处理和数据发布等统计生产全过程的元数据标准,提高统计能力和统计工作的规范化和标准化水平,准确诠释宏微观统计数据,实现统计数据的交换与共享。

三、企业一套表主要元数据标准

统计指标与统计分组是统计的两个基本要素,统计目录是统计报表中对某些指标指定填报具体品种的规定,这三者都是统计调查制度和统计资料中大量出现的事物,是统计元数据的重要组成部分。因此,配合企业一套表的实施,首先制定统计指标、统计分组和统计目录三项主要元数据标准,包括元数据的概念、基本属性构成和描述,以及管理信息等内容的技术规范。

(一)统计指标元数据标准

统计指标是根据统计研究某种社会经济现象的目的,确定调查总体和调查总体单位,并对调查总体各单位标志的具体表现进行登记、

165

汇总,从而形成说明调查总体综合特征的各种资料。

统计指标元数据标准从统计指标的基本属性、管理属性和数据属性三方面进行规定和定义,共计47项。具体内容见表1。

表1:统计指标元数据标准

160

165

160

165

(二)统计分组/目录元数据标准

统计分组是根据统计研究的需要,将总体中的所有单位按一定的标志划分成若干组成部分,使同一组的单位具有同质性,组与组之间保持明显的差别,从而反映总体内部的不同类型,研究总体的结构、比例以及现象之间的依存关系。统计目录是统计报表中对某些数量指标需要填报的具体品种或内容的规定。

统计分组和统计目录具有相同的元数据标准内容,均从基本属性和管理属性两方面进行规定和定义,共计39项。具体内容见表2。

表2:统计分组/目录元数据标准

160

165

160

165

160

附表:1. 企业一套表元数据标准指标库

2.企业一套表元数据标准分组/目录库

165

元数据的概念

元数据的概念 元数据(Metadata),即关于数据的数据,是对数据和信息资源进行描述的信息。通常认为,元数据是为了更为有效地管理和使用数据而对它进行说明的信息。所以元数据与其描述的数据内容有着密切联系,不同领域的数据的元数据在内容 上差异很大。地理空间数据的元数据是地理空间的空间数据和属性数据以外的描述地理信息空间数据集的内容、质量、状态和其它特性的一类数据,它是实现地理空间信息共享的核心标准之一。其中,对空间数据某一特征的描述,称为一个空间元数据元素。空间元数据是一个由若干复杂或简单的元数据项组成的集合。它与非空间元数据的主要区别在于其内容中包含大量与空间位置有关的描述性信息。 研究元数据的作用和意义 元数据可用来帮助数据提供者和数据使用者解决数据转换、沟通和理解的问题。归纳起来,元数据主要有下列几个方面的作用: 1)、用来组织、管理和维护空间数据,建立数据文档,并保证即使其主要工作人员退休或调离时,也不会失去对数据情况的了解 2)、提供数据存储、数据分类、数据内容、数据质量及数据分发等方面的信息,帮助数据使用者查询检索所需地理空间数据 3)、用来建立空间信息的数据目录和数据交换中心,提供通过网络对数据进行查询检索的方法或途径,以及与数据交换和传输有关的辅助信息 4)、通过空间元数据,人们可以接受并理解空间信息,帮助数据使用者了解数据, 以便就数据是否能满足其需求作出正确的判断并与自己的空间信息集成在一起,进行不同方面的科学分析和决策。 元数据是使数据充分发挥作用的重要条件之一。它可以用于许多方面,包括数据文档建立、数据发布、数据浏览、数据转换等。元数据对于促进数据的管理、使用和共享均有重要的作用。元数据对于建立空间数据交换网络是十分重要的,往往网络中心通过设在中心的元数据库可以实时地连接各个分发数据的分节点元数据库,帮助潜在的用户找到其特定应用所需要的数据,实现数据共享。 一个完整的元数据系统通常包括三部分,即元数据标准、元数据管理工具和元数据库。不同的元数据库可能采用不同的管理工具,唯一能够在不同数据管理软件间交换元数据的途径是统一元数据标准,只有在统一的标准前提下,才能跨越操作系统平台和数据库软件平台进行数据的互操作,实现数据共享。 DIF 元数据标准

行业分类(统计)

行业分类(统计)

行业分类 第一部分行业分类的有关概念和原则 一、经济活动 国民经济行业分类是按照各单位(或劳动者)从事的经济活动进行分类。一般情况下,一个单位至少有两种类型的经济活动,一种是对外提供产品或劳务的活动,一种是为保障单位正常运转所从事的辅助活动。单位对外提供的活动往往也不是单一的,有主要活动和次要活动之分。在划分行业时,首先要明确单位从事的哪些是主要活动,哪些是次要活动,哪些是辅助活动。 (一)主要活动 当一个单位对外从事两种或两种以上的经济活动时,占其单位收入份额最大的一种活动为主要活动。 在实际工作中,有些活动的增加值份额较确定,则可依次按照主营业务活动收入、全年营业收入、从业人员确定单位的主要活动。凡有主营业务收入的,按照主营业务收入确定单位的主要活动;如果没有主营业务收入的,按照以下方法确定单位的主要活动,采矿、制造、电力、燃气及水的生产和供应等活动按照销售收入判断。 (二)次要活动 一个单位对外从事的所有经济活动中,除主要活动以外的经济活动为次要活动。或者说,是占单位收入份额不是最大的那些活动。 (三)辅助活动 辅助活动是保证本单位主要活动和次要活动正常运转而进行的一种内部活动,一般不对外提供产品和劳务。如水、电气的供应活动、企业产品的销售活动、通信及网络管理活动、财务管理、人员管理活动等。 二、国民经济行业的划分原则 一个行业(或产业)是指从事相同性质的经济活动的所有单位的集合。 (一)一般性原则 国民经济行业分类采用经济活动的同质性原则划分行业类别。即每一个行业类别都按照相同性质的经济活动归类,而不是依据行政事业编制、会计制度和部门管理归类。

中文数字化期刊的dc 元数据标准设计实例情报科学vol1 21no1 6

中文数字化期刊的DC 元数据标准设计实例 刘廷元 (西南石油学院图书馆,成都610500) 摘 要 文章将元数据标准的使用作为各种不同的数字化期刊仓储资源共享的一种可行性方法进行了论 述。研究集中在三个方面:首先,讨论了数字化期刊采用元数据标准的必要性;其次,讨论了数字化期刊的 DC 元数据定义与限定;最后,提供了一个用DC 111元数据和H TM L 410语法设计的中文数字化期刊元数据 标准实例。 关键词 元数据 标准 数字化期刊 中文期刊 设计 中图分类号 G 35311 文献标识码 A 文章编号 100727634(2003)0620609204 An Exam ple of the DC M etada ta Standard D esign for Ch i nese D ig ita l Journa ls L iu T ingyuan (L ib rary of Sou thw est Petro leum In stitu te ,Chengdu 610500) Abstract T h is article deseribes the u se of m etadata standards as a viab le m ean s fo r shared resou rces among vari ou s differen t digital j ou rnalw arehou ses .O u r study concen trates on th ree con ten ts :F irst ,the article discu ssed under the necessity of u sing the m etadata standard in digital j ou rnals .Second ,the article discu ssed the sem an tic defin iti on and li m itati on of the DC elem en t set fo r digital j ou rnals .F inally ,w e p rovided the m etadata standard of the Ch inese digital j ou rnals and an examp le of the design w ith the DC 1.1m etadata and H TM L 4.0syn tax . Keywords M etadata Standard D igital Jou rnal Ch inese Jou rnal D esign 收稿日期:2002-09-09 数字化信息的结构化存储、有序化组织和高效、准确的 检索,是数字化图书馆与商业数据库共同面临的一个问题。由于WWW 空间的无限扩大,使得解决全球信息资源的无组织问题更加迫切。目前,因特网上既有OCL C 、U nCover 那样庞大的数字化期刊服务,也有BaderL ine 、EBSCO ho st 、P roQ uest D irect 、Sp ringer 数字化期刊、CN K I 中国学术期刊网、维普中文科技期刊、万方中国数字化期刊网这样新兴的数字化全文期刊数据库服务,以及不断增加的上千种的网上出版期刊。然而,这样巨大的期刊信息资源仓储却是以异构方式存在的,它们提供各自不同的信息存储、组织、检索与浏览方法,不能实现跨仓储的统一查找利用,造成了极大的信息资源浪费。 因特网上分布式的异构数字化期刊仓储如同一个没有索引卡片的传统图书馆。但是,如果我们为这些数字化期刊的信息存储、组织、检索与浏览加上一个无形的统一索引目录——元数据标准,网上数字化期刊就会成为一个单一的、虚拟的、有组织的信息集合体,实现全球期刊信息的资源共享和跨仓储无缝查找,使期刊文献检索的查全率和查准率大大提高,从而极大地方便广大读者和用户。 1 数字化期刊采用DC 元数据标 准的必要性 大多数数字化期刊(尤其是全文期刊数据库)都习惯采用自己特有的数字信息储存、检索技术,人为地使自己的产品在使用方式、字段、接口设计等方面造成差异和封闭。强调产品的差异性而又不遵守统一的制作标准与规范,谋求利润最大化而又自我封闭,这就是数字化期刊制作与出版过程中普遍存在的二律悖反现象。正是由于这种分布式的异构与封闭,才阻碍了当今信息资源的透明、公开、可扩展、互操作性、组织性和规模化建设,使数字化期刊在当今知识经济时代难以受到人们更多的喜爱。 具体地说,数字化期刊采用元数据标准的必要性主要有以下四个方面。 (1)元数据描述能够为数字化期刊建立一种计算机普遍 可以理解的框架体系,使数字化期刊资源得以透明、公开。因为元数据描述了数字化信息的内容、权利和外部环境这些基本特征,使得计算机系统可以自动辨识、抽取、分析和整合,进而使得数字化期刊信息简单、有效的被其它信息资源仓储利用。 (2)元数据的描述、标识和语法能够融入因特网通用的 语言中,被迅速地装载或转换进各种索引数据库,使数字化期刊资源具有可扩展和互操作性。一方面,建立在通用标记语言(SG M L )和扩展标记语言(X M L )之上的元数据语言,是国际互联网的通用语言,能够非常方便地被相同的元数据语言装载。另一方面,即使是对于各种不同数字化期刊仓储类型的元数据体系,只要我们以W F 和RD F 为基础,通过语 第21卷第6期 2003年6月     情 报 科 学   V o l 121,N o 16June, 2003

元数据与元数据标准现状

元数据与元数据标准现状 福建省空间工程研究中心黄瑞垠 目前国内外研究领域对元数据含义的理解虽然存在认识深浅的区别,但总体上达成了共识[[i]]。学者们大都认可“元数据是关于数据的数据”或“描述数据的数据”的观点,但对于其具体含义,又有不同阐述。张晓林等[[ii]]认为“元数据是描述信息资源或数据等对象的数据,其使用目的在于:识别资源、评价资源、追踪资源在使用过程中的变化,实现简单高效地管理大量网络化数据,实现信息资源的有效发现、查找、一体化组织和对使用资源的有效管理”。肖珑[[iii]]认为元数据“是用于提供某种资料的有关信息的结构化数据(Structured data)”。张智雄[[iv]]将元数据定义为“描述任何Internet数据和资源,促进Internet信息资源的组织和发现的数据”。李郎达[[v]]引用国际图联对元数据的定义:“Metadata即描述资料的资料,可用来协助对网络电子资源的辨识、描述、指示其位置的任何资料”。 根据以上定义,参考其他学者的观点,关于元数据,可小结如下: (1)元数据的目标:元数据的根本目标是使数据库更易于使用,或为计算机辅助软件工程(CASE)服务。 (2)元数据的内容:元数据包括对数据集的描述;对数据集中各数据项(来源、数据所有者、数据生产历史)等的说明;数据质量的描述,如:数据精度、分辨率、源数据的比例尺等;数据处理信息,如量纲的转换等;数据转换方法;数据库更新、集成的方法等等。 (3)元数据的性质:元数据是数据的描述性数据;对不同领域的数据库,元数据的内容有很大差异;元数据应尽可能反映数据的特征及规律。 (4)元数据的作用:通过元数据可以检索、访问数据库,可以有效利用计算机的系统资源,可以对数据进行加工处理和二次开发等。 在此基础上,我们将元数据概括为以数据高效利用和交换为目的的数据集说明性数据,它主要包括对数据集、与数据集相关信息、数据集各数据项说明以及数据用户访问、检索、更新数据库的方法,同时元数据也包括基于不同数据领域,如何尽可能全面反映基本数据的信息。

CELTS-42基础教育教学资源元数据规范1

基础教育教学资源元数据应用规范 (CELTS-41) 教 育信息化技术标准 CELTS-42 基础教育教学资源元数据规范 CELTS-42 CD1.6 教育部教育信息化技术标准委员会 发布

目录 1 概述 (2) 1.1 目的 (2) 1.2 范围 (2) 2 规范性引用文件 (2) 3 术语定义与缩略语 (3) 3.1 本应用规范使用的基础术语 (3) 3.2 缩略语 (5) 4 元数据元素属性定义 (6) 4.1 元数据元素的属性描述 (6) 4.2 数据元素定义的规定 (7) 5 元数据结构 (7) 5.1 元数据的基本结构 (7) 5.2 元数据元素及定义 (7) 6 限定词汇与编目词汇表 (11) 6.1 限定词汇 (11) 6.2 本规范的限定词与编目方式定义 (14) 6.3 受控词汇和编目方案 (22) 6.4 一致性 (29) 7 参考文献 (31) 附录 A 供参考的部分教育学科课程分类第三级词汇表(课程内容) (33) A.1 语文课程内容分类 (33) A.2 数学课程内容分类 (34) A.3 英语课程内容分类 (37) A.4 地理课程内容分类 (38) A.5 历史课程内容分类 (39) A.6 化学课程内容分类 (40) A.7 物理课程内容分类 (43) A.8 生物课程内容分类 (48) A.9 信息技术课程内容分类 (49) A.10 音乐课程内容分类 (50) A.11 美术课程内容分类 (50)

CELTS-42基础教育教学资源元数据规范 1 概述 1.1 目的 本规范提供一个面向基础教育的教学资源数据模型。制定本规范旨在对希望在学校、企业、其他机构和个人的教学资源中使用元数据的用户提供一套资源编目准则,以使读者能快速、有效地在国家基础教育资源库及门户网站中检索到所需的教学资源,广泛地实现资源共享。 1.2 范围 本规范在《CELTS-3学习对象元数据:信息模型规范》(以下简称《学习对象元数据规范》)的基础上,结合我国基础教育的实际,定义了一组面向基础教育的教学资源元数据元素。 本规范依照教育部颁布的《义务教育课程设置实验方案》、《义务教育各学科课程标准(实验稿)》以及《学习对象元数据规范》,同时参考《都柏林核心集元数据(DCMES)》、《中国图书馆图书分类法》、美国GEM项目及澳大利亚EdNA项目的词汇分类方法,定义了一组用于元数据元素编目的受控词汇及相应的词汇表。 本规范通过与《学习对象元数据规范》的元素间映射来实现与CELTS的一致性。 本规范包括﹕ ?概述 ?规范性引用文件 ?术语定义与缩略语 ?元数据元素属性定义 ?元数据结构 ?限定词汇及编目词汇表 ?一致性 ?参考文献 2 规范性引用文件 下列文件中的条款通过本规范的引用而成为本应用规范的条款。凡是注日期的引用文件,其随后所有的修改单(不包括勘误的内容)或修订版均不适用于本应用规范。然而,鼓励根据本标准达成协议的各方研究是否可使用这些文件的最新版本。凡是不注日期的引用文件,其最新版本适用于本应用规范。 ?ISO 639:规定人类语言表示方法的国际标准。 ?ISO 646:规定ASCII字符集的国际标准。 ?ISO 8601:规定日期和时间表示方法的国际标准。 ?ISO 3166:规定国家名称表示方法的国际标准。

专门数字对象描述元数据规范

专门数字对象描述元数据规范 研制工作手册 (试行) 《专门数字对象描述元数据规范》子项目组 2003年3月 为了保证子项目组研制的各种元数据规范在功能、数据结构、格式、语义语法等方面的一致性和整体性,同时也为了今后在更大范围内实现与其他系统或数字图书馆的互操作和数据共享,项目组特制定本手册。 手册主要内容包括: 1,描述元数据的定义及功能 2,元数据规范的设计原则 3,描述元数据的基本结构、元素组成与扩展规则 4,描述体系与定义方法 5,元数据规范应用的相关规则 6,设计流程与工作规范 7,文档规范 本手册为试行稿,其中很多内容尚需在实际工作过程进行修订,涉及到核心元素集、元素定义方法、扩展规则、描述体系等方面的内容,将与“基本描述元数据规范”子项目组进一步探讨后确定。各工作小组可暂时按此执行,在执行过程中如有问题,可向子项目组提出,并在子项目组会议上讨论修改并通过。 一、描述元数据的定义及功能 描述元数据:即用于描述或标识数字对象内容的元数据。 设计描述元数据规范时,要充分考虑和实现元数据的下列功能: 描述:对信息对象的内容、属性等的描述,是元数据最基本的功能,为信息对象的检索与利用奠定了基础。 定位:即有关信息资源的位置方面的信息,如DOI、URL、URN等的记录,由此可知信息对象之所在,有利于信息的发现和检索。 管理:对信息对象的权限管理(版权、所有权、使用权)的揭示和描述。 检索:在描述过程中,将信息对象中的重要信息抽出标引并加以组织,建立它们之间的关系,为用户提供多层次、多途径的检索体系,从而有利于用户发现其真正需要的信息。 评估和选择:由于元数据的描述,使用户在不必浏览信息对象本身的情况下,对信息对象有了基本了解和认识,可以对其价值进行评估,从而决定信息的取舍。 交互:包括与编目人员和用户之间的交互。元数据在结构上呈现出一定的开放性,允许

新产业新业态新商业模式统计分类2018

新产业新业态新商业模式统计分类(2018) 一、分类目的 根据党中央、国务院关于加快发展新产业新业态新商业模式(简称“三新”)的要求,为科学界定“三新”活动范围,满足统计上监测“三新”经济活动规模、结构和质量等需要,制定本分类。 二、分类范围 本分类的范围包括:现代农林牧渔业、先进制造业、新型能源活动、节能环保活动、互联网与现代信息技术服务、现代技术服务与创新创业服务、现代生产性服务活动、新型生活性服务活动、现代综合管理活动。 三、分类原则 (一)以党中央、国务院关于加快发展“三新”的有关要求为指导,根据《中华人民共和国国民经济和社会发展第十三个五年规划纲要》《国务院关于印发〈中国制造2025〉的通知》(国发〔2015〕28号)、《国务院关于积极推进“互联网+”行动的指导意见》(国发〔2015〕40号)和《国务院关于大力推进大众创业万众创新若干政策措施的意见》(国发〔2015〕32号)等文件中有关“三新”活动的阐述,确定“三新”活动的范围和分类。 (二)参照《战略性新兴产业分类(2017)》(试行)、《高技术产业(制造业)分类(2017)》《高技术产业(服务业)分类(2018)》《国家科技服务业统计分类(2015)》等

相关统计分类标准,重点体现先进制造业、互联网+、创新创业、跨界综合管理等“三新”活动。 (三)以现行《国民经济行业分类》(GB/T 4754-2017)为基础,对其中符合“三新”特征的有关活动进行再分类。 (四)注重实际可操作性,立足现行统计制度和方法,充分考虑数据的可获得性,以保证统计部门能够采集到“三新”活动的数据。 四、结构和编码 本分类采用线分类法和分层次编码方法,将“三新”活动划分为三层,分别用阿拉伯数字编码表示。第一层为大类,用2位数字表示,共有9个大类;第二层为中类,用4位数字表示,共有63个中类;第三层为小类,用6位数字表示,共有353个小类。 本分类代码结构: ×××××× (数字)小类顺序码 小类代码 (数字)中类顺序码 中类代码 (数字)大类代码 五、有关说明 (一)本分类建立了与《国民经济行业分类》的对应关系,在国民经济行业类别中仅部分活动属于“三新”统计分类的,行业

国家基础地理信息系统元数据标准(草案)

国家基础地理信息系统(NFGIS)元数据标准草案(初稿) 1. 主题内容与适用范围 本标准提供国家基础地理信息系统(NFGIS)元数据的内容,包括NFGIS数据的标识、内容、质量、状况及其他有关特征。本标准可用于对NFGIS数据集的全面描述、数据集编目及信息交换网络服务。 2. 参考标准 ISO 15046-15地理信息--元数据(CD 2.0) FGDC 地理空间数据元数据内容标准(CSDGM)v.2.0 3. 术语 3.1 元数据 是关于数据的数据,即关于数据的内容、质量、状况和其他特性的信息。也可译为描述数据或诠释数据。 3.2 元数据元素(元数据Element) 元数据最基本的信息单元。 3.3 元数据实体(元数据Entity) 同类元数据元素的集合。 3.4 元数据子集(元数据Section) 相互关联的元数据实体和元素的集合。 3.5 信息交换网络(Clearinghouse) 数据生产者、管理者和用户之间的分布式、电子连接的网络。 3.6 数据志(Lineage) 数据继承信息,包括获取或生产数据使用的原始资料说明、数据处理中的参数、步骤等情况及负责单位的有关信息等。 3.7 引用文献(Citation) 数据集引用或参考使用的资料、数据集、模型、文献等。 4. NFGIS 元数据层次结构和性质 4.1 元数据层次结构 本标准规定NFGIS元数据分为三层:元数据子集、元数据实体和元数据元素。 元数据元素是元数据的最基本的信息单元,元数据实体是同类元数据元素的集合,元数据子

集是相互关联的元数据实体和元素的集合。在同一个子集中,实体可以有两类即简单实体和复合实体,简单实体只包含元素,复合实体既包含简单实体又包含元素,同时复合实体与简单实体及构成这两种实体的元素之间具有继承关系。 4.2 元数据性质 本标准定义三种性质的元数据子集、实体和元素: 必选(Mandatory)──元数据的核心内容,适用于各种被描述对象,是元数据文件必须包含的子集、实体或元素。 一定条件下必选(Conditional )──针对不同的被描述对象特征元数据文件所必须提供的子集、实体或元素。 可选(Optional)──该子集、实体或元素是可选的,由用户决定是否将其包含在元数据文件中。 5. NFGIS 元数据分级和特征 5.1 元数据分级 本标准规定元数据分为两级,即: 基本元数据──提供地理数据源基本文档所需要的最少的元数据元素集。它包括回答下列问题的元数据元素: "是否有特定主题的数据集('什么')?"、"是否有特定地区的数据集('何处')?"、"是否有特定时段的数据集('何时')?" 以及"订购或了解数据集更多情况的联系人('谁')? 完全元数据──提供完整的地理数据源(单独的数据集、数据集系列、各种地理要素)文档所需要的必选的和可选的元数据元素集。它完整地定义全部元数据,以便标识、评价、摘录、使用和管理地理信息。 5.2 元数据特征 本元数据标准定义了8种特征: 5.2.1 名称 赋给元数据实体或元素的标记。 5.2.2 标识码 计算机中使用的定义每个元数据实体和元素的唯一代码。代码结构为: xx xx xx 前两位为元数据子集,两位数字码 中间两位为元数据实体/独立元素,两位数字码 后两位为元数据实体包含的元素,两位数字码

科学数据规范化分析与管理

科学数据规范化分析与管理
中国科学院计算机网络信息中心 胡良霖 2008年05月

提纲
1. 2. 3.
基本概念 科学数据的特点 科学数据规范化
规范化分析 3.2 规范化管理
3.1
4. 5.
示例模型 科学数据规范化工作模式

1. 基本概念
数据(data) 对事实、概念或指令的一种形式化表示,适用于以人 工或自动方式进行通信、解释或处理。 数据集(dataset) 可以标识的数据集合。 注:数据集可以是一个数据库或一个或多个数据文件。 元数据 (metadata)
定义和描述其他数据的数据。
数据模型(data model) 以反应信息结构的某种方式对数据组织的描述。 描述数据、数据关系、数据语义以及一致性约束的概 念工具的集合。[《数据库系统概念》(第三版)]
注:以上概念除特殊注明外均摘自GB/T18391.1-2002《信息技术的规范化与标准化 第一部分:数据 元的规范化与标准化框架》

1. 基本概念
数据元(data element)
用一组属性描述其定义、标识、表示和允许值的数据单元,在 一定语境下,通常用于构建一个语义正确、独立且无歧义的特 定概念语义的信息单元。
注:数据元也是构建元数据和元数据实体的基本单元。
数据元目录(data element directory)
列出并定义了全部相关数据元的一种信息资源。
注:数据元目录可有不同层级,例如,ISO/IEC委员会级、国际协会 级、行业部门级、公司级、应用系统级。
数据元值(data element value)
数据元允许值集合中的一个值。
数据元值的长度(data element value length)
数据元值中字符的数目。
注:按ASCII字符数目计算数据元值的长度,一个汉字相当于2个字符。
注:以上概念释义均出自GB/T18391.1-2002。

元数据的标准

元数据的标准 1、数字图书馆资源组织框架 2. 元数据开发应用框架 元数据的基本意义Metadata(元数据)是“关于数据的数据”; 元数据为各种形态的数字化信息单元和资源集合提供规范、普遍的描述方法和检索工具;元数据为分布的、由多种数字化资源有机构成的信息体系(如数字图书馆)提供整合的工具与纽带。 离开元数据的数字图书馆将是一盘散沙,将无法提供有效的检索和处理。 3. 元数据应用环境 3.1 Metadata的应用目的 (1)确认和检索(Discovery andentification),主要致力于如何帮助人们检索和确认所需要的资源,数据元素往往限于作者、标题、主题、位置等简单信息,Dublin Core是其典型代表。(2)著录描述(Cataloging),用于对数据单元进行详细、全面的著录描述,数据元素囊括内容、载体、位置与获取方式、制作与利用方法、甚至相关数据单元方面等,数据元素数量往往较多,MARC、GILS和FGDC/CSDGM是这类Metadata的典型代表。 (3)资源管理(Resource Administration),支持资源的存储和使用管理,数据元素除比较全面的著录描述信息外,还往往包括权利管理(Rights/Privacy Management)、电子签名(Digital Signature)、资源评鉴(Seal of Approval/Rating)、使用管理(Access Management)、支付审计(Payment and Accounting)等方面的信息。 (4)资源保护与长期保存(Preservation and Archiving),支持对资源进行长期保存,数据元素除对资源进行描述和确认外,往往包括详细的格式信息、制作信息、保护条件、转换方式(Migration Methods)、保存责任等内容。 3.2 Metadata在不同领域的应用根据不同领域的数据特点和应用需要,90年代以来,许多Metadata格式在各个不同领域出现 例如: 网络资源:Dublin Core、IAFA Template、CDF、Web Collections 文献资料:MARC(with 856 Field),Dublic Core 人文科学:TEI Header 社会科学数据集:ICPSR SGML Codebook 博物馆与艺术作品:CIMI、CDWA、RLG REACH Element Set、VRA Core 政府信息:GILS 地理空间信息:FGDC/CSDGM 数字图像:MOA2 metadata、CDL metadata、Open Archives Format、VRA Core、NISO/CLIR/RLG Technical Metadata for Images 档案库与资源集合:EAD 技术报告:RFC 1807 连续图像:MPEG-7 3.3 Metadata格式的应用程度 不同领域的Metadata处于不同的标准化阶段: 在网络资源描述方面,Dublin Core经过多年国际性努力,已经成为一个广为接受和应用的事实标准;在政府信息方面,由于美国政府大力推动和有关法律、标准的实行,GILS已经

林业科学数据元数据标准

林业科学数据元数据标准(V3.10版) 1 主题容与适应围 本标准规定了用来描述林业科学数据集及提供信息服务所需要的信息,包括林业科学数据共享元数据容框架和林业科学数据共享元数据标准。提供了有关林业科学数据集的标识、容、分发、数据质量、数据表现、参照系和元数据参考信息等容。 本标准适用于林业科学数据集元数据整理、建库、汇编、发布及共享服务。 本标准的元数据分为两级,即核心元数据和详细元数据。核心元数据规定了描述数据集最关键的信息容。在核心元数据的基础上,考虑林业科学研究的特点,建立满足林业科学数据共享建设的详细元数据。用户可以在核心元数据的基础上,根据具体需求和数据的实际情况选用、扩充详细元数据容,建立相应级别的元数据库。 2 规性引用文件 下列规性引用文件通过本部分的引用而成为本标准的条款。凡是注日期的引用文件,其随后所有的修改单(不包括勘误的容)或修订版均不适用于本标准。但是,鼓励根据本标准达成协议的各方,研究是否可使用这些文件的最新版本。但是不注日期的引用文件,其最新版本适用于本标准。ISO和IEC成员维护目前有效国际标准的注册。 科学数据共享工程技术标准—科学数据共享元数据标准容1.4 SDS/T 2112—2004 科学数据共享工程技术标准 GB/T 1.1—2000 标准化工作导则 GB/T 7408-1994 数据元和交换格式信息交换日期和时间表示方法 GB/T 4880.2-2000 语种名称代码第2部分:3字母代码 GB/T 2260-2002 中华人民国行政区划代码 GB/T 7156-1987 文献等级代码 SDS/T 2111—2004 元数据标准化原则与方法 SDS/T 2122—2004 科学数据共享工程数据分类编码 ISO 19115 地理信息—元数据(Geographic information—Metadata) 3 术语和定义 3.1 数据集dataset 数据集是可以表示的数据集合,数据集可以是数据库,也可以是数据库中的一个(逻辑组成)部分。本标准所指的数据集是指不可再细分的数据集,即可以用一个数据字典能够唯一描述的数据集合。3.2 数据集系列dataset series 数据集系列是同一主题的多个数据集的组合,都符合相同产品规。 3.3 元数据metadata 元数据是关于数据的数据,用来描述数据的容、覆盖围、质量、管理方式、数据的所有者、数据的提供方式等有关信息。 3.4 元数据元素 metadata element

数据元的规范与标准化框架

数据元的规范与标准化框架 数据表示和管理的基本概念 .数据元 数据元是称之为数据的一个广义概念的特殊成员。总而言之,数据是事实、想法或命令的一种表示数据被收集、组织、记录、处理和存放在一个可检索的表中。数据还必须适用于以人工或自动方式进行交换、解释及加工处理。 有许多结构用于数据组织与管理,如数据合成、实体、文件、对象类、对象、记录、关联、关系、行、段、主体域、表以及元组。它们与数据元并不具有相似性,但可以包括或通过一些数据库实现或逻辑建模来等同于数据元的支持。 字节和位也是数据的构件,尽管它们被用于电子媒体中数据元的注册,但并不等同于数据元。在数据库中,数据元可以作为信息组(符号组、域)或字符列来处理。在的数据模型中,它是一个属性(见图)。在某特定的相关环境中被视为不可分割时,一个数据元则被作为一个单独的数据单位在自然界中,它是数据的单位,表示关于对象类的单独事实。(如:一个被赋值“”和“”的字符码表示了“雇员”这一对象类的婚姻状态的属性)。在其使用范围内,它不可能被分解为更多且具有有用含义的基本信息组。因而,数据元可被定义为在用户论述领域内是与用户相关的。数据元是自然界中对象类特性以电子或书面形式的表示。 表示 一个特性可由能够被人们解释的某一符号集来体现。一个单独的特性可由几个交替的数据元甚至数据元组(通常称之为数据合成,有时也称之为数据元集或数据元链)来表示。这样,一个特性可以由数据元组构成的数据合成或一个单独的数据元表征。 常用法 所有数据从业者和理论家都会涉及数据元的概念。无论用什么方法或技术,数据元都是整个软件开发生命周期()的公用纽带。在的早期阶段,它们曾被视为实体(或对象类)的属性在的后期,具体的数据值被赋予它们的实例作为符号组或字符列。在的任一阶段,对于软件的生产者和用户来说,数据元是可识别的数据元是数据共享和共同持有的最小单元。一些数据元得以共享的信息系统成分有)企业信息模型)数据模型)数据流程图)数据库设计(模式、文件、表格))接口规范)计算机程序 1.2.1数据模型中的数据元 在数据建模出现之前,“数据元”这个术语已被普遍使用。用于表示指导企业商务信息的数据单元传统上被称之为数据元。数据建模的演进就是为捕捉这些数据表示的语义提供一种有效的方法。图描述了用于中的数据元结构和术语与一些更为传统数据建模术语的关联在一个

国家统计局-行业分类标准47347

[1]农、林、牧、渔业 [01]农业 [02]林业 [03]畜牧业 [04]渔业 [05]农、林、牧、渔服务业 [2]采矿业 [06]煤炭开采和洗选业 [07]石油和天然气开采业 [08]黑色金属矿采选业 [09]有色金属矿采选业 [10]非金属矿采选业 [11]其他采矿业 [3]制造业 [13]农副食品加工业 [14]食品制造业 [15]饮料制造业 [16]烟草制品业 [17]纺织业 [18]纺织服装、鞋、帽制造业 [19]皮革、毛皮、羽毛(绒)及其制品业 [20]木材加工及木、竹、藤、棕、草制品业[21]家具制造业 [22]造纸及纸制品业 [23]印刷业和记录媒介的复 制 [24]文教体育用品制造业 [25]石油加工、炼焦及核燃 料加工业 [26]化学原料及化学制品制 造业 [27]医药制造业 [28]化学纤维制造业 [29]橡胶制品业 [30]塑料制品业 [31]非金属矿物制品业 [32]黑色金属冶炼及压延加 工业 [33]有色金属冶炼及压延加 工业 [34]金属制品业 [35]通用设备制造业 [36]专用设备制造业 [37]交通运输设备制造业 [39]电气机械及器材制造业 [40]通信设备、计算机及其 他电子设备制造业 [41]仪器仪表及文化、办公 用机械制造业 [42]工艺品及其他制造业 [43]废弃资源和废旧材料回 收加工业 [4]电力、煤气及水的生产和 供应业 [44]电力、热力的生产和供 应业 [45]煤气生产和供应业 [46]水的生产和供应业 [5]建筑业 [47]房屋和土木工程建筑业 [48]建筑安装业 [49]建筑装饰业 [50]其他建筑业 [6]交通运输、仓储及邮政业 [51]铁路运输业 [52]道路运输业 [53]城市公共交通业 [54]水上运输业 [55]航空运输业 [56]管道运输业 [57]装卸搬运和其他运输服 务业 [58]仓储业 [59]邮政业 [7]信息传输、计算机服务和 软件业 [60]电信和其他信息传输服 务业 [61]计算机服务业 [62]软件业 [8]批发和零售业 [63]批发业 [65]零售业 [9]住宿和餐饮业 [66]住宿业 [67]餐饮业 [10]金融业 [68]银行业 [69]证券业 [70]保险业 [71]其他金融活动 [11]房地产业 [72]房地产业 [12]租赁和商务服务业 [73]租赁业 [74]商务服务业 [13]科学研究、技术服务和 地质勘查业 [75]研究与试验发展 [76]专业技术服务业 [77]科技交流和推广服务业 [78]地质勘查业 [14]水利、环境和公共设施 管理业 [79]水利管理业 [80]环境管理业 [81]公共设施管理业 [15]居民服务和其他服务业 [82]居民服务业 [83]其他服务业 [16]教育 [84]教育 [17]卫生、社会保障和社会 福利业 [85]卫生 [86]社会保障业

体育产业统计分类

体育产业统计分类() 一、分类目的 为加快推动体育产业发展,科学界定体育产业的统计范围,建立体育产业统计调查制度,依据《国务院关于加快发展体育产业促进体育消费的若干意见》(国发〔〕号)、《国务院关于印发全民健身计划(年)的通知》(国发〔〕号)和《国务院办公厅关于加快发展健身休闲产业的指导意见》(国办发〔〕号),以《国民经济行业分类》()为基础,制定本分类。 二、概念界定和分类范围 体育产业是指为社会提供各种体育产品(货物和服务)和体育相关产品的生产活动的集合。分类范围包括:体育管理活动,体育竞赛表演活动,体育健身休闲活动,体育场地和设施管理,体育经纪与代理、广告与会展、表演与设计服务,体育教育与培训,体育传媒与信息服务,其他体育服务,体育用品及相关产品制造,体育用品及相关产品销售、出租与贸易代理,体育场地设施建设等个大类。 三、编制原则 (一)以国务院有关文件为指导。本分类主要依据《国务院关于加快发展体育产业促进体育消费的若干意见》《国务院关于印发全民健身计划(年)的通知》和《国务院办公厅关于加

快发展健身休闲产业的指导意见》提出的重点任务,确定体育产业的基本范围。 (二)以《国民经济行业分类》为基础。本分类以《国民经济行业分类》()为基础,是对国民经济行业分类中符合体育产业特征的有关活动的再分类。 (三)突出我国体育活动的特点。本分类突出了我国体育活动的特点和实际发展现状,充分考虑了体育产业发展中的新业态和新模式。 四、结构和编码 本分类采用线分类法和分层次编码方法,将体育产业划分为三层,分别用阿拉伯数字编码表示。第一层为大类,用位数字编码表示,共有个大类;第二层为中类,用位数字编码表示,前两位为大类代码,共有个中类;第三层为小类,用位数字编码表示,前三位为中类代码,共有个小类。 代码结构: ×××× (数字)小类顺序码 小类代码 (数字)中类顺序码 中类代码 (数字)大类代码 五、有关说明 3 / 11

电子文件元数据规范

电子文件元数据规范 1 范围 本规范适用于九省区各级国家档案馆、各级党政机关、社会团体、企事业单位对电子文件进行以保证凭证性为目的的管理活动。其他社会组织可参照执行 在电子文件管理过程中使用元数据可实现以下目的: ——确保并证明归档电子文件的真实性、完整性与有效性,从而保证其凭证价值; ——有利于归档电子文件的保护,实现长期保存; ——在异构的信息系统中对归档电子文件进行规范、有效的管理,保证归档电子文件的可捕获、可收集、查长期利用; ——对归档电子文件及馆(室)藏档案数字化资源进行集成管理,实现有效、方便地查询、检索与利用。 2 规范性引用文件 下列文件中的条款通过本规范的引用而成为本规范的条款。凡是注明日期的引用文件,其随后所有的修改单(不包括勘误的内容)或修订版均不适用于本规范,然而,鼓励根据本规范达成协议的各方研究是否可使用这些文件的最新版本。 GB 2312-1980 信息交换用汉字编码字符集基本集 GB/T 3760-1995 文献叙词标引规则 GB/T 3792.1-1983 文献著录总则 GB/T 7156-2003 文献保密等级代码 GB/T 7408-2005 数据元和交换格式信息交换日期和时间表示法 GB/T 9704-1999 国家行政机关公文格式 GB/T 11714-1997 全国组织机构代码编制规则 GB/T 11821-2002 照片档案管理规范 GB/T 13959-1992 文件格式与代码编制方法 GB/T 13967-1992 全宗单 GB/T 15418-1994 档案分类标引规则 GB 18030-2000 信息技术信息交换用汉字编码字符集基本集的扩充 GB/T 18894-2002 电子文件归档与管理规范 DA/T 1-2000 档案工作基本术语 DA/T 12-1994 全宗卷规范 DA/T 13-1994 档号编制规则 DA/T 18-1999 档案著录规则 DA/T 19-1999 档案主题标引规则 DA/T 22-2000 归档文件整理规则 DA/T 31-2005 纸质档案数字化技术规范 《中华人民共和国电子签名法》 中办发[1996]14号中国共产党机关公文处理条例 国发﹝2000﹞23号关于发布《国家行政机关公文处理办法》的通知 国档发[1987]4号关于颁发《编制全国档案馆名称代码实施细则》的通知 国家档案局第6号令《电子公文归档管理暂行办法》,2003年7月28日 国家档案局第8号令《机关文件材料归档范围和文书档案保管期限规定》,2006年12月19日ISO 15489 Information and documentation—Records management ISO 23081-1 Information and documentation – Records Management Processes – Metadata for Records—Part 1: Principles

国家统计局节能环保产业分类表

附表2 国家统计局节能环保产业分类表 产业分类名称行业代码 产品代码 行业名称 产品名称 高效节能产业 高效节能通用设备制造 3411 锅炉及辅助设备制造 节能型电站锅炉 节能型工业锅炉 节能型船用蒸汽锅炉 H型省煤器 高低差速循环流化床油页岩锅炉 秸秆发电锅炉 煤泥循环流化床锅炉 蓄热稳燃高炉煤气锅炉 350104 锅炉用辅助设备及装置 350106 核反应堆及其零件 高效煤粉工业锅炉 3441 泵及真空设备制造 节能泵 节能型真空干燥设备 节能型真空炉 其他节能型真空应用设备 3442 气体压缩机械制造 节能型制冷设备用压缩机 节能型非制冷设备用压缩机 3444 液压和气压动力机械及元件制造 节能液压元件制造 节能气压元件制造 3461 烘炉、熔炉及电炉制造 节能型炉用燃烧器 节能型机械加煤机及类似装置 节能工业电炉 节能型非电热金属处理用炉 节能型辊道窑 节能型隧道窑 节能型梭式窑 节能型推板窑 节能型保护气氛窑炉

产业分类名称 行业代码 产品代码 行业名称 产品名称 节能型氮化窑 节能型烧成窑炉 节能型烘烤干燥炉 钢坯步进蓄热式加热炉 其他节能型窑炉、熔炉 3462 风机、风扇制造 节能型风机 节能型工业风扇 节能型工业用通风罩、循环气罩 3464 制冷、空调设备制造 节能型工商用制冷设备 节能型工商用冷藏、冷冻柜及类似设备 节能型中央空调冷水/热泵机组 节能型工商用空调设备 3490 其他通用设备制造业 节能型干燥设备 高效节能专用设备制造 3511 矿山机械制造 节能型建井设备 节能型采掘、凿岩设备 节能型矿山提升设备 节能型矿物破碎机械 节能型矿物粉磨机械 节能型矿物筛分、洗选设备 节能型矿山牵引车及其矿车 节能型矿山设备专用配套件 3515 建筑材料生产专用机械制造 节能型建筑材料专用窑炉 节能型水泥专用设备 节能型建筑材料制品成型机械 节能型建筑材料及制品专用机械零件 节能型建筑卫生陶瓷机械 3516 冶金专用设备制造 节能型金属冶炼设备 节能型金属轧制设备 节能型冶金专用设备配套件 3521 炼油、化工生产专用设备制造 节能型热交换装置 节能型化工专用炉 3531 食品、酒、饮料及茶生产专用设备制造 — 2 —

中国科学院科学数据库

项目编号:INF105-SDB-3 文档编号:P/SDBSP-1.1.1 版本:1.0 中国科学院科学数据库 通用元数据管理工具用户使用手册 中国科学院计算机网络信息中心 科学数据库中心 2003 年9 月

目录 1引言 (1) 1.1编写目的 (1) 1.2背景 (1) 1.3技术支持 (1) 2功能 (2) 3运行环境 (3) 3.1硬件环境 (3) 3.2软件环境 (3) 4操作指南 (4) 4.1用户类型 (4) 4.2 用户登录 (5) 4.2.1系统管理员的登录 (5) 4.2.2单位管理员的登录 (7) 4.2.3一般用户的登录 (9) 4.3 用户密码管理 (11) 4.4 界面风格定制 (12) 4.4.1 添加元数据界面的设定 (12) 4.4.2 查询界面的设定 (13) 4.4.3 概要显示的设定 (13) 4.4.4 详细显示界面的设定 (13) 4.5 添加元数据 (15) 4.6 元数据记录修改 (15) 4.7 元数据记录删除 (16) 4.8 元数据查询 (18) 4.8.1 单位内元数据的查询 (18) 4.8.2 针对XML Schema跨单位的查询 (18) 4.8.3 查询方法 (19) 4.8.4查询结果的显示 (19) 4.9 出错处理和恢复 (21)

1引言 1.1编写目的 感谢您选用《通用元数据管理工具》管理数据库数据集,为了使各建库单位能够准确、方便的使用《通用元数据管理工具》对科学数据库数据集进行元数据描述和管理,特编写了《通用元数据管理工具》用户手册。该手册适用于各建库单位具体负责元数据管理的数据库系统管理人员以及元数据录入人员。 1.2背景 《通用元数据管理工具》是为了配合科学数据库元数据标准规范的推广应用而研发的基于xml schema的元数据管理专用工具,是科学数据库及其应用系统的研究成果之一。 科学数据库及其应用系统是中国科学院多个研究所参加、跨学科联合建设的综合型重大项目,是中国科学院知识创新工程信息化建设重大专项之一,目标是在中国科学院全院范围内将研究所多年积累的科学数据资源组织起来,与计算机、数据库和网络等先进技术相结合,促进数据向知识的转化,完善信息化的科学研究环境,并对科研与社会提供科技数据资源共享与服务。 科学数据库及其应用系统涉及到资源建设、规范建设和系统平台设计等多方面的技术、资源的发掘、研究、积累与应用。为了实现分布式的跨平台的数据资源共享,在科学数据库及其应用系统的研发和建立中,必须研究制定面向各个学科数据集的元数据标准。为此该项目设立了“标准规范研究子项目”,经过较长时间的研究,标准规范研究小组已经制定了以XML Schema描述的“中国科学院科学数据库核心元数据标准”以及多个面向具体学科数据集的元数据标准,为了更好的推广应用这些元数据标准,中国科学院计算机网络信息中心科学数据库中心研发了《通用元数据管理工具》。 目前,该工具已在中国科学院计算机网络信息中心试用近半年,运行稳定。 1.3技术支持 科学数据库中心:北京市海淀区中关村南四街4号中国科学院计算机网络信息中心 科学数据库中心 邮编:100080 电话:(8610)62580066 传真:(8610)62578544 Email: md@https://www.doczj.com/doc/ff16211555.html, 网址:https://www.doczj.com/doc/ff16211555.html,;https://www.doczj.com/doc/ff16211555.html,

相关主题
文本预览
相关文档 最新文档