- 1、本文档共66页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
主题法在网络信息组织中的运用 主题法在网络信息组织中的应用现状 主题法在网络信息组织中的使用主要表现为两种方式,一是使用现有词表(叙词表、标题表)组织网络信息。目前,使用现有词表组织网络信息的还不多,主要是美国《国会图书馆标题法》 (LCSH) 和《医学标题表》 (MeSH) 被一些网络信息检索系统采用。采用 LCSH 的系统有: CyberHoundExpertSearch,ElectronicJournalSubjectIndex 等。采用 MeSH 的系统有: CliniWebBrowse,AlphabeticalListofNLMSections 等。 主题法在网络信息组织中的运用 二是广泛采用关键词法。关键词法是将信息原来所用的能描述其主题概念的关键词抽出,不加规范或只作极少量的规范化处理,按字顺排列,以提供检索途径的方法。由于关键词法具有种种优点,关键词的抽取可以完全自动化,因此关键词检索在网络中的应用相当广泛。目前,大部分搜索引擎的索引数据库几乎都采用关键词法进行信息组织。 关键词法作为信息组织的标识,在标引时不必查表、选词,标引速度快、成本低,特别适合网络信息的特点。网络信息最主要的特点就是数量庞杂而且增长迅速。使用关键词法可以降低信息标引的成本,提高标引工作的效率。关键词法不依赖专职标引人员,可由作者或机器自动标引。 现在搜索引擎一般用“蜘蛛”去完成标引工作,就是利用了关键词法的这一优点,不存在人为性和滞后性。采用关键词法,能够及时地应用最新的提法以及最新的词汇,不会像其它情报检索语言那样要依靠词表来对语词选择和规范,而词表的制定和修改是需要一个过程的,这样就不可避免的带来滞后性。 同时关键词法可以采用自动标引的方式,不会产生人工标引那种“仁者见仁,智者见智”的局面。这也就是关键词法在网络信息组织中得到广泛应用的主要原因。 主题法在网络信息组织中的运用 3.3.1 网络索引机器人 (1)网络索引机器人定义: (2)网络索引机器人工作原理 3.3.2 网络搜索引擎 (1)网络搜索引擎定义: (2)建立搜索引擎的关键技术 搜索引擎 搜索引擎起源于1990年加拿大麦吉尔大学(University of McGill)计算机学院的师生开发出的Archie。当时,万维网(World Wide Web)还没有出现,人们通过FTP来共享交流资源。Archie能定期搜集并分析FTP服务器上的文件名信息,提供查找分布在各个FTP主机中的文件。 用户必须输入精确的文件名进行搜索,Archie告诉用户哪个FTP服务器能下载该文件。它虽然和现代的搜索引擎不同,但原理是相同的,所以Archie是搜索引擎的鼻祖。搜索引擎实际是一个根据一定的策略、运用特定的计算机程序搜集互联网上的信 息,在对信息进行组织和处理后,为用户提供检索服务的系统。 1995年,一种新的搜索引擎形式出现了———元搜索引擎(Meta Search Engine) 。与传统搜索引擎的不同之处在于,它是通过一个操作平台,聚集并调用一批独立搜索引擎同时进行搜索的检索工具。 用户只需提交一次搜索请求,由元搜索引擎负责转换处理后提交给多个预先选定的独立搜索引擎,并将从各独立搜索引擎返回的所有查询结果,集中起来处理后再返回给用户。应该说元搜索引擎是个非常好的概念,但搜索效果还不理想,所以没有哪个元搜索引擎有过强势地位,普及程度不理想。 GOOGEL 简介 Google(www.G)是一个搜索引擎,由两个斯坦福大学博士生Larry Page与Sergey Brin于1998年9月发明, Google Inc. 于1999年创立。2000年7月份,Google替代Inktomi成为Yahoo公司的搜索引擎,同年9月份,Google成为中国网易公司的搜索引擎。98年至今,Google已经获得30多项业界大奖。 GOOGLE 的成功得益于其强大的功能和独到的特点: Google检索网页数量达24亿,搜索引擎中排名第一; Google支持多达132种语言,包括简体中文和繁体中文; Google网站只提供搜索引擎功能,没有花里胡哨的累赘; Google速度极快,年初时据说有15000多台服务器,200多条T3级宽带; Google的专利网页级别技术PageRank能够提供准确率极高的搜索结果; Google智能化的“手气不错”功能,提供可能最符合要求的网站; Google的“网页快照”功能,能从Google服务器里直接取出缓存的网页。 Google具有独到的图片搜索功能; Google具有强大的新闻组搜索功能; Google具有二进制文件搜索功能(PDF,DOC,SWF等); Google还有很多尚在开发阶段的令人吃惊的设想和功能。 主题法在网络信息组织中
您可能关注的文档
- 侵略及反抗复习.ppt
- 儿发 第一篇 绪论.ppt
- 使带有信道衰落的集中式认知无线网络达到最优化及低复杂度的动态频谱接入算法.ppt
- 体育运动卫生及保健.ppt
- 公共关系理及实务第11章.ppt
- 公共组织财务管理 第4篇 收入管理.ppt
- 先进文化落后文化.ppt
- 公民的基本权利与义务-粤教沪科版.ppt
- 公司金融第4篇 资本预算 第2节.ppt
- 公开课(李)语言表达及运用.ppt
- 浙江衢州市卫生健康委员会衢州市直公立医院高层次紧缺人才招聘11人笔试模拟试题参考答案详解.docx
- 浙江温州泰顺县退役军人事务局招聘编外工作人员笔试备考题库及参考答案详解一套.docx
- 江苏靖江市数据局公开招聘编外工作人员笔试模拟试题及参考答案详解.docx
- 广东茂名市公安局电白分局招聘警务辅助人员40人笔试模拟试题带答案详解.docx
- 江苏盐城市大丰区住房和城乡建设局招聘劳务派遣工作人员4人笔试模拟试题带答案详解.docx
- 浙江舟山岱山县东沙镇人民政府招聘笔试模拟试题及参考答案详解1套.docx
- 最高人民检察院直属事业单位2025年度公开招聘工作人员笔试模拟试题含答案详解.docx
- 浙江金华市委宣传部、中共金华市委网信办所属事业单位选调工作人员笔试备考题库及答案详解1套.docx
- 广东深圳市党建组织员招聘40人笔试模拟试题及答案详解1套.docx
- 江苏南京水利科学研究院招聘非在编工作人员4人笔试模拟试题及参考答案详解.docx
最近下载
- 2025年4月20日四川省事业单位考试《公共基础知识》试题及答案解析参考.pdf
- 中层竞聘面试题目答案.doc VIP
- 电力系统优化与调度软件:PLEXOS二次开发_(4).电力系统优化理论.docx VIP
- 传染病、消毒知识测试题及答案.docx VIP
- 2025年解放军联勤保障部队第960医院医护人员招聘备考试题及答案解析.docx VIP
- 2021年版国家免疫规划疫苗儿童免疫程序相关知识考核试题含答案.docx VIP
- 电力系统优化与调度软件:Xpress二次开发_(3).电力系统优化问题的数学建模.docx VIP
- 中建钢筋精算管理操作手册.pdf VIP
- 电商仓库主管月工作总结.pptx
- 预防接种工作规范(2023版)试题.docx VIP
文档评论(0)