信息的检索第三章信息的著录和标引

  1. 1、下载文档前请自行甄别文档内容的完整性,平台不提供额外的编辑、内容补充、找答案等附加服务。
  2. 2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
  3. 3、如文档侵犯您的权益,请联系客服反馈,我们会尽快为您处理(人工客服工作时间:9:00-18:30)。

实用标准文案

第三章信息著录和标引

信息著录的含义和标准3.1信息著录的含义一、信息著录:简称著录,指在组织检索系统时对文献内容和形式特征进行选择和记录的过程。著录对象是信息,著录结果是款目或记录。

款目:指依据一定的标准方法,对一种文献或信息源的内容价值物质形态进行描述而形成的一条记录。款目由一条条著录项目组成。

著录项目:用于揭示文献内容和形式特征的记录事项。

信息著录的基本要求:①准确性。要求著录结果准确全面客观的揭示文献或其它信息源的内容特征或形式特征②规范化。要求信息著录坚持标准化原则,按照统一的著录项目,著录格式,标识符号进行著录。

信息著录的作用二、1、揭示功能:信息著录主要反映的是文献本身的特征,通过对文献全面系统的分析,揭示出其内容特征和形式特征,将其浓缩于只言片语中,从而表达文献的基本信息。

2、组织功能:信息著录后形成的款目或记录,是编制目录的基础,也是组织数据库数据的基本单元。文献编目包括信息著录和目录组织两步。信息著录是对文献内容特征形式特征进行选择记录后形成款目或记录。目录组织是将这些款目或记录按照一定组织规则编排在一起最终形成检索工具或数据库。

3、检索功能:存储是检索的第一个阶段,即将表达文献特征的有检索意义的标识通过记录组织成手工检索工具或计算机数据库,而表达文献特征的标识需要通过著录和标引来完成。作为信息

著录结果的款目或记录,记载了表达文献特征的各种标识。

精彩文档.

实用标准文案

信息著录的标准三、《文献著录总则》旨在根据各种类型文献的共同特点,确定文献著录原则、内容、标识符号、格式等的统一规定。具有指导作用为信息著录提供原则性框架,并不作为文献著录的直接依据。

1、著录项目:①题名与责任者项②版本项③文献特殊细节项④出版发行项⑤载体形态项⑥丛编项⑦附注项⑧文献标准编号及有关记载项⑨提要项

2、著录级次:著录文献的详简程度,分为三级:①简要级次,款目仅著录主要项目②基本级次,著录主要项目同时还著录部分选择项目③详细级次,著录全部主要项目和全部选择项目。

3、著录格式:款目中各个著录项目的排列次序和表达方式。分为卡片式款目著录格式和书本式款目著录格式。

目前,信息机构中并存着两种目录,一种是卡片式目录,一种是机读目录。

机读目录与元数据3.2机读目录一、机读目录(MARC):机器可读目录的简称,来自英文machine-readable catalogue的简称,是利用计算机识读和处理的目录。CNMARC:按照UNIMARC格式设计原则制定,并结合了汉字的特点,标识系统和数据代码规定比较详细,目前广泛应用于计算机编目。

一条CNMARC记录由记录头标区(包括的数据有记录类型,书目级别,记录的完备精彩文档.实用标准文案

程度,记录是否遵照国际标准书目著录规则等),地址目次区(记录关于数据字段区记录情况的有关数据),数据字段区(由一些可变长数据组成,有十个功能块,0-标识信息块,1-编码信息块,2-著录信息块,3-附注项,4-款目连接块,5-相关题名块,6-主题分析块,7-知识责任者块,8-国际使用块,9-国内使用块),记录分隔符组成。

元数据二、元数据:metadata,关于数据的数据。在互联网中,元数据是指描述任何互联网数据和资源,促进互联网信息资源组织和发现的数据,以协助对网络资源的识别、描述、位置指示。

元数据的作用:1、定位和检索:借助于元数据,人们可以准确地检索和确认所需的资源。

2、著录和描述:为了提高查全率和查准率,需要对网络资源的数据单元进行详细的著录和描述,描述数据单元的元数据叫做元数据元素。

3、资源管理:利用元数据全面描述网络资源,不仅有利于检索,同时也有利于实现对资源安全有效的管理。

4、资源保护与长期保存:利用元数据全面描述网络资源,不仅有利于实现管理和查询,还有助于网络资源的保护和长期保存。

都柏林核心元数据集:一种跨领域的信息资源描述标准。其对应用的资源类型没有根本性的限制。共包括15个元素:①题名(title)②创作者(creator)③主题及关键词(subject

and keywords)④描述(description )⑤出版者(publisher)⑥其他贡献者(contributor)⑦时间(date)⑧类型(type)⑨格式(format)⑩标识(identifier)⑾来源(source)⑿语言(language)⒀关联(relation)⒁范围(coverage)⒂版权精彩文档.

实用标准文案

(right)这十五个元素都是可选择可重复可扩展的。目前许多国家部门将都柏林核心元数据集作为一项基础标准。

都柏林核心元数据和机读目录的比较三、都:①简单②灵活③具有语义互操作性④可扩展性,有利于网络信息资源描述

机:①揭示内容深入详尽②在信息存储和检索领域应用历史悠久,是一种国际性的书目著录标准相同:①两者都是元数据②在著录文献的相关信息上都是数据的数据③目的:将文献的相关信息格式化④用来描述信息资源的主题内容特征,并通过所描述的特征提供检索的依据

不同:1、著录对象不同:都的著录对象是网络资源或数据资源,其设计原则有可选择性可重复性可扩展性。机比较适合传统出版物、缩微制品、数据库等,适用范围主要限于图书情报机构和网上公共查询目录

2、数据形式不同:都包括15个元素,在应用中可选择可重复可扩展,限定词与元素之间关系灵活,结构简单灵巧。机由记录头标区、地址目次区、数据字段区、分隔符组成,结构严谨复杂。

3、著录主体不同:都著录简单明了,创建者和提供者无需培训即可自己进行资源描述。机著录格式复杂内容严格,对使用者要求高,只有专业编目人员才能使用。

4、著录详简程度不同:都德著录比较简单,只有15个元素,在著录过程中可选择可重复课扩展顺序可任意编排。机著录详尽细致,有严格的著录规则。

5、标识方法不同:都直接采用单词或词组进行标识,表达直观语义明确。机字段用3位阿拉伯数字标识,子字段用1位英文字母或阿拉伯数字标识,不具备语义。

精彩文档.

实用标准文案

相关文档
最新文档