网站大量收购独家精品文档,联系QQ:2885784924

信息检索第三章信息著录和标引.docVIP

  1. 1、本文档共8页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  5. 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  6. 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  7. 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  8. 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
信息检索第三章信息著录和标引.doc

第三章 信息著录和标引 3.1信息著录的含义和标准 一、信息著录的含义 信息著录:简称著录,指在组织检索系统时对文献内容和形式特征进行选择和记录的过程。著录对象是信息,著录结果是款目或记录。 款目:指依据一定的标准方法,对一种文献或信息源的内容价值物质形态进行描述而形成的一条记录。款目由一条条著录项目组成。 著录项目:用于揭示文献内容和形式特征的记录事项。 信息著录的基本要求:①准确性。要求著录结果准确全面客观的揭示文献或其它信息源的内容特征或形式特征②规范化。要求信息著录坚持标准化原则,按照统一的著录项目,著录格式,标识符号进行著录。 二、信息著录的作用 1、揭示功能:信息著录主要反映的是文献本身的特征,通过对文献全面系统的分析,揭示出其内容特征和形式特征,将其浓缩于只言片语中,从而表达文献的基本信息。 2、组织功能:信息著录后形成的款目或记录,是编制目录的基础,也是组织数据库数据的基本单元。文献编目包括信息著录和目录组织两步。信息著录是对文献内容特征形式特征进行选择记录后形成款目或记录。目录组织是将这些款目或记录按照一定组织规则编排在一起最终形成检索工具或数据库。 3、检索功能:存储是检索的第一个阶段,即将表达文献特征的有检索意义的标识通过记录组织成手工检索工具或计算机数据库,而表达文献特征的标识需要通过著录和标引来完成。作为信息著录结果的款目或记录,记载了表达文献特征的各种标识。 三、信息著录的标准 《文献著录总则》旨在根据各种类型文献的共同特点,确定文献著录原则、内容、标识符号、格式等的统一规定。具有指导作用为信息著录提供原则性框架,并不作为文献著录的直接依据。 1、著录项目:①题名与责任者项②版本项③文献特殊细节项④出版发行项⑤载体形态项⑥丛编项⑦附注项⑧文献标准编号及有关记载项⑨提要项 2、著录级次:著录文献的详简程度,分为三级:①简要级次,款目仅著录主要项目②基本级次,著录主要项目同时还著录部分选择项目③详细级次,著录全部主要项目和全部选择项目。 3、著录格式:款目中各个著录项目的排列次序和表达方式。分为卡片式款目著录格式和书本式款目著录格式。 目前,信息机构中并存着两种目录,一种是卡片式目录,一种是机读目录。 3.2机读目录与元数据 一、机读目录 机读目录(MARC):机器可读目录的简称,来自英文machine-readable catalogue的简称,是利用计算机识读和处理的目录。 CNMARC:按照UNIMARC格式设计原则制定,并结合了汉字的特点,标识系统和数据代码规定比较详细,目前广泛应用于计算机编目。 一条CNMARC记录由记录头标区(包括的数据有记录类型,书目级别,记录的完备程度,记录是否遵照国际标准书目著录规则等),地址目次区(记录关于数据字段区记录情况的有关数据),数据字段区(由一些可变长数据组成,有十个功能块,0-标识信息块,1-编码信息块,2-著录信息块,3-附注项,4-款目连接块,5-相关题名块,6-主题分析块,7-知识责任者块,8-国际使用块,9-国内使用块),记录分隔符组成。 二、元数据 元数据:metadata,关于数据的数据。在互联网中,元数据是指描述任何互联网数据和资源,促进互联网信息资源组织和发现的数据,以协助对网络资源的识别、描述、位置指示。 元数据的作用:1、定位和检索:借助于元数据,人们可以准确地检索和确认所需的资源。 2、著录和描述:为了提高查全率和查准率,需要对网络资源的数据单元进行详细的著录和描述,描述数据单元的元数据叫做元数据元素。 3、资源管理:利用元数据全面描述网络资源,不仅有利于检索,同时也有利于实现对资源安全有效的管理。 4、资源保护与长期保存:利用元数据全面描述网络资源,不仅有利于实现管理和查询,还有助于网络资源的保护和长期保存。 都柏林核心元数据集:一种跨领域的信息资源描述标准。其对应用的资源类型没有根本性的限制。共包括15个元素:①题名(title)②创作者(creator)③主题及关键词(subject and keywords)④描述(description )⑤出版者(publisher)⑥其他贡献者(contributor)⑦时间(date)⑧类型(type)⑨格式(format)⑩标识(identifier)⑾来源(source)⑿语言(language)⒀关联(relation)⒁范围(coverage)⒂版权(right)这十五个元素都是可选择可重复可扩展的。目前许多国家部门将都柏林核心元数据集作为一项基础标准。 三、都柏林核心元数据和机读目录的比较 都:①简单②灵活③具有语义互操作性④可扩展性,有利于网络信息资源描述 机:①揭示内容深入详尽②在信息存储和检索领域应用历史悠久,是一种国际性的书目著录标准 相同:①两者都是元数据②在著录

文档评论(0)

ziyouzizai + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档