信息检索 第三章 信息著录和标引

信息检索 第三章 信息著录和标引

ID:1320901

大小:62.00 KB

页数:7页

时间:2017-11-10

信息检索 第三章 信息著录和标引_第1页
信息检索 第三章 信息著录和标引_第2页
信息检索 第三章 信息著录和标引_第3页
信息检索 第三章 信息著录和标引_第4页
信息检索 第三章 信息著录和标引_第5页
资源描述:

《信息检索 第三章 信息著录和标引》由会员上传分享,免费在线阅读,更多相关内容在应用文档-天天文库

1、第三章信息著录和标引3.1信息著录的含义和标准一、信息著录的含义信息著录:简称著录,指在组织检索系统时对文献内容和形式特征进行选择和记录的过程。著录对象是信息,著录结果是款目或记录。款目:指依据一定的标准方法,对一种文献或信息源的内容价值物质形态进行描述而形成的一条记录。款目由一条条著录项目组成。著录项目:用于揭示文献内容和形式特征的记录事项。信息著录的基本要求:①准确性。要求著录结果准确全面客观的揭示文献或其它信息源的内容特征或形式特征②规范化。要求信息著录坚持标准化原则,按照统一的著录项目,著录格式,标识符号进行著录。二、信息著录的作用1、揭示功能:信息著录主要反映的是文献

2、本身的特征,通过对文献全面系统的分析,揭示出其内容特征和形式特征,将其浓缩于只言片语中,从而表达文献的基本信息。2、组织功能:信息著录后形成的款目或记录,是编制目录的基础,也是组织数据库数据的基本单元。文献编目包括信息著录和目录组织两步。信息著录是对文献内容特征形式特征进行选择记录后形成款目或记录。目录组织是将这些款目或记录按照一定组织规则编排在一起最终形成检索工具或数据库。3、检索功能:存储是检索的第一个阶段,即将表达文献特征的有检索意义的标识通过记录组织成手工检索工具或计算机数据库,而表达文献特征的标识需要通过著录和标引来完成。作为信息著录结果的款目或记录,记载了表达文献特

3、征的各种标识。三、信息著录的标准《文献著录总则》旨在根据各种类型文献的共同特点,确定文献著录原则、内容、标识符号、格式等的统一规定。具有指导作用为信息著录提供原则性框架,并不作为文献著录的直接依据。1、著录项目:①题名与责任者项②版本项③文献特殊细节项④出版发行项⑤载体形态项⑥丛编项⑦附注项⑧文献标准编号及有关记载项⑨提要项2、著录级次:著录文献的详简程度,分为三级:①简要级次,款目仅著录主要项目②基本级次,著录主要项目同时还著录部分选择项目③详细级次,著录全部主要项目和全部选择项目。3、著录格式:款目中各个著录项目的排列次序和表达方式。分为卡片式款目著录格式和书本式款目著录格

4、式。目前,信息机构中并存着两种目录,一种是卡片式目录,一种是机读目录。3.2机读目录与元数据一、机读目录机读目录(MARC):机器可读目录的简称,来自英文machine-readablecatalogue的简称,是利用计算机识读和处理的目录。7CNMARC:按照UNIMARC格式设计原则制定,并结合了汉字的特点,标识系统和数据代码规定比较详细,目前广泛应用于计算机编目。一条CNMARC记录由记录头标区(包括的数据有记录类型,书目级别,记录的完备程度,记录是否遵照国际标准书目著录规则等),地址目次区(记录关于数据字段区记录情况的有关数据),数据字段区(由一些可变长数据组成,有十个

5、功能块,0-标识信息块,1-编码信息块,2-著录信息块,3-附注项,4-款目连接块,5-相关题名块,6-主题分析块,7-知识责任者块,8-国际使用块,9-国内使用块),记录分隔符组成。二、元数据元数据:metadata,关于数据的数据。在互联网中,元数据是指描述任何互联网数据和资源,促进互联网信息资源组织和发现的数据,以协助对网络资源的识别、描述、位置指示。元数据的作用:1、定位和检索:借助于元数据,人们可以准确地检索和确认所需的资源。2、著录和描述:为了提高查全率和查准率,需要对网络资源的数据单元进行详细的著录和描述,描述数据单元的元数据叫做元数据元素。3、资源管理:利用元数

6、据全面描述网络资源,不仅有利于检索,同时也有利于实现对资源安全有效的管理。4、资源保护与长期保存:利用元数据全面描述网络资源,不仅有利于实现管理和查询,还有助于网络资源的保护和长期保存。都柏林核心元数据集:一种跨领域的信息资源描述标准。其对应用的资源类型没有根本性的限制。共包括15个元素:①题名(title)②创作者(creator)③主题及关键词(subjectandkeywords)④描述(description)⑤出版者(publisher)⑥其他贡献者(contributor)⑦时间(date)⑧类型(type)⑨格式(format)⑩标识(identifier)⑾来源

7、(source)⑿语言(language)⒀关联(relation)⒁范围(coverage)⒂版权(right)这十五个元素都是可选择可重复可扩展的。目前许多国家部门将都柏林核心元数据集作为一项基础标准。三、都柏林核心元数据和机读目录的比较都:①简单②灵活③具有语义互操作性④可扩展性,有利于网络信息资源描述机:①揭示内容深入详尽②在信息存储和检索领域应用历史悠久,是一种国际性的书目著录标准相同:①两者都是元数据②在著录文献的相关信息上都是数据的数据③目的:将文献的相关信息格式化④用来描述信

当前文档最多预览五页,下载文档查看全文

此文档下载收益归作者所有

当前文档最多预览五页,下载文档查看全文
温馨提示:
1. 部分包含数学公式或PPT动画的文件,查看预览时可能会显示错乱或异常,文件下载后无此问题,请放心下载。
2. 本文档由用户上传,版权归属用户,天天文库负责整理代发布。如果您对本文档版权有争议请及时联系客服。
3. 下载前请仔细阅读文档内容,确认文档内容符合您的需求后进行下载,若出现内容与标题不符可向本站投诉处理。
4. 下载文档时可能由于网络波动等原因无法下载或下载错误,付费完成后未能成功下载的用户请联系客服处理。