下载此文档

元数据管理方案.pdf


文档分类:办公文档 | 页数:约6页 举报非法文档有奖
1/6
下载提示
  • 1.该资料是网友上传的,本站提供全文预览,预览什么样,下载就什么样。
  • 2.下载该文档所得收入归上传者、原创者。
  • 3.下载的文档,不会出现我们的网址水印。
1/6 下载此文档
文档列表 文档介绍
元数据管理方案

为了简化元数据生成工作,系统提供自动生成元数据的功能,即元数据抽取。通过
元数据自动抽取,用户可以方便、快捷地获得大量的元数据信息。

元数据抽取主要针对的对象有以下几种:
元数据管理方案

为了简化元数据生成工作,系统提供自动生成元数据的功能,即元数据抽取。通过
元数据自动抽取,用户可以方便、快捷地获得大量的元数据信息。

元数据抽取主要针对的对象有以下几种:
已有目录:已建业务应用系统中现有的目录资源。
数据库:各种数据库资源,包括关系型数据库、XML数据库等。
格式化电子文件:电子文件,例如Word、PDF、XLS等文件。

元数据抽取的流程有4个主要步骤,分别为:
数据源信息获取:解决要从哪个数据源获得元数据的问题。
内容/结构分析:解决要从数据源中获得哪些元数据的问题。
元数据提取:解决如何从数据源中获取元数据的问题。
存储入库:解决元数据存储的问题。

对于电子文档,首先各部门的文档格式不尽相同,另外它们的安全级别也各不相同,
同时由于信息化建设水平的不一致,有的部门文档分散在各处,有的部门文档是集中存
放的,甚至已经建立了完善的电子系统进行管理。
针对以上状况,对于电子文档的元数据抽取需要进行以下的抽取流程:
整理归档
对于分散在各处的电子文档(纸质文档需要先进行电子化处理),必须由专人进行统一整理,根据公开共享的前提进行集中,这种集中可以是物理上集中的,也可以是逻辑
上集中的。但要满足以下原则,第一根据安全级别,便于外界访问;第二便于文档的增
量发布;第三便于采集工具的自动化采集编目。各部门只有在文档完全整理归档的情况
下,进行自动化采集才是切实可行的。在整理归档的时候,各部门根据各自情况进行归
档,没有必要千篇一律,也没有必要制定繁琐和呆板的规则,只要能够满足以上的原则
即可。
根据安全级别,建立相应的访问机制
由于受到安全级别的限制,所以对于需要共享的数据要进行安全方面的限制,限制
的手段可以有:用户名/密码、数字证书、物理隔断等等,根据实际情况建立安全访问机
制,做到重要信息不泄露,不丢失。
编目处理
现阶段,主流格式的电子文档,主要包含:word、excel、ppt、pdf等。对主流格式
的电子文档,要提供自动采集工具进行编目处理。采集的范围主要是文档的标题和内容,
对于其它的元数据内容,要提供手工配置的方式进行辅助。另外,在工具的采集效率上,
要提高增量文档发布后的采集效率。
对于格式特殊、内容有加密算法的文档,是很难通过抓取工具进行采集的,这些文
档主要通过手工编目的方式来处理。
对于存在管理库的文档,就需要对数据库来进行编目采集,详见数据库元数据抽取
部分。
保存元数据
采集后的数据要放到数据库或者保存到硬盘上,另外要根据目录体系标准,把数据
分解为元数据,然后进行存储

数据中心需要抽取的数据库类型主要为Sqlserver,首先利用ETL工具从源数据库中
将所需数据抽取至中心数据库基础业务库中,在利用元数据著录工具对抽取出来的数据
进行元数

元数据管理方案 来自淘豆网m.daumloan.com转载请标明出处.

相关文档 更多>>
非法内容举报中心
文档信息
  • 页数6
  • 收藏数0 收藏
  • 顶次数0
  • 上传人小sjj
  • 文件大小374 KB
  • 时间2022-09-12