- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
《文件检索及写作》结业论文
[文档副标题]
2015年10月13日
信息检索效率的探讨
摘要
在信息技术迅速发展的推动下,传统信息服务机构和网络信息服务运营商逐步走上由信息服务向知识服务的转型之路。在这种趋势下,信息检索也由过去单纯的字符匹配逐步转向面向内容、基于知识的信息检索。在这里简单探讨一下基于知识服务的信息检索效率的基本概念和评价指标,剖析语义分析程度、信息模型、检索方法和信息收录范围等主要影响因素,最后通过一个实例,对比分析说明知识服务将提高用户信息检索的效率。
关键词:知识服务;信息检索:效率
引言
进入知识经济时代,知识管理、知识服务的理念得到广泛认同,信息检索技术也由基于关键词的信息检索逐步转向针对文章内容的基于知识的信息检索。后者不再是基于字符的机械匹配,而是更强调语义,模拟人类的思维方式,从语义和概念出发,自动分析信息资源的语义信息,查找和发现具有相关知识单元的信息资源。较之前者,其检索结果更准确,更贴近用户需求。信息检索是将信息按照一定的规律组织起来,找到所需信息的过程和技术,简单的说,就是信息的有序化识别和查找。信息检索效率就是实施识别和查找过程的效率。信息检索效率不仅是影响信息检索工具价值的重要因素,也是评价信息检索技术发展的重要指标。
目录
1、 信息检索效率 3
1.1、 检全率 3
1.2、 检准率 3
1.3、 友好性 3
1.4、 检索耗时 3
2、 影响因素分析 3
2.1、 语义分析程度 3
2.1.1、 语义分析 4
2.1.2、 语义分析的内容 4
2.1.3、 语义分析对检索效率的影响 4
2.2、 检索模型 4
2.2.1、布尔模型 5
2.2.2、 向量模型 5
2.2.3、 概率模型 5
2.2.4、 基于本体的信息检索模型 5
2.3、 检索方法 5
2.3.1、 目录式检索 6
2.3.2、 搜索引擎 6
2.3.3、 在线数据库查询 6
2.4、 信息收录范圈 6
3 、检索实倒分析 7
4 、结束语 7
5 、参考文献 7
1信息检索效率
基于知识服务的主要评价指标有检全率、检准率、友好性和检索耗时。
1.1、 检全率
检出相关信息的记录数与系统中全部相关信息的记录数之比。这里的相关信息是指具有语义联系的信息。
1.2、 检准率
是指检出相关记录数与检出全部相关记录数之比。
1.3、 友好性
对检索结果按照相关度进行排序,便于用户率先查看相关度高的结果再看相关度低的结果,减少用户定位到目标结果的耗时。
1.4、 检索耗时
是指从用户提交请求到计算机返回检索结果所消耗的时长,由网络速度和检索算法决定。
2、 影响因素分析
基于知识服务的信息检索是建立在语义理解基础之上的智能检索过程,影响检索效率的因素主要有语义分析、信息模型、检索方法和信息收录范围,分述如下。
2.1、 语义分析程度
2.1.1、 语义分析
语义分析是在提供信息检索服务之前,对收录信息资源进行语义层面的分析,发现和标记信息资源的知识单元及相互联系,构建基于信息资源本质内容的知识库。语义分析的目的在于控制检索的语义范围,从而控制检索的范围,保证检索出全部与某特定学科内容相关的信息,剔除所有与此学科内容不相干的信息。可以说,信息检索的范围与语义分析的程度息息相关,语义分析程度越充分,发现的知识单元越丰富,检索结果越全面、准确;反之,语义分析程度不够,能够发现和标记的知识单元就相对较少,检全率和检准率都会降低导致检索效率低下。
2.1.2、 语义分析的内容
针对信息资源内容的语义分析包括两个方面:基于内容的定性分析和定量分析。基于内容的定性分析是对信息内容的学科属性进行分析和鉴定。通过语义分析,确定信息所属范畴,从而限定了信息检索的范围。目前定性分析的方法主要有专家法和机器学习法。基于内容的的定量分析是定量的分析信息资源之间的关系,通过对信息资源所含知识单元的数量特征、数量关系和数量发展进行统计分析,区分核心信息资源和一般信息资源的知识单元的差异。
2.1.3、 语义分析对检索效率的影响
信息内容的定性分析能够分析和鉴定信息的学科属性,控制检索的语义范同,保证了能够检索出全部与特定学科内容相关的信息,剔除不相关的信息,提高了信息检索的检全率和检准率。信息内容的定量分析从数量的角度分析信息资源的相互关系,区分出核心信息资源和一般信息资源,使检索过程优先匹配核心信息资源,缩减平均匹配时间,提高检索效率。因此,信息资源的语义分析程度是影响信息检索效率的关键因素。
2.2、 检索模型
信息检索模型是描述信息检索过程中文档表示,查询及其相互关系的模型。信息检索模型决定了查询过程的效率。目前主要的信息检索模型有布尔模型、向量空间模型、概念模型和基于本体的信息检索模型。
2.2.1、布尔模型
布尔模型是基于集
您可能关注的文档
最近下载
- 【交通运输类】浙江省汽车维修行业工时定额和收费标准浙江省交通厅浙江省物价局精编.pdf VIP
- TD-JZ2006-6001西南设计院预埋件图集.pdf
- 01J925 1 压型板屋面.PDF VIP
- 视听语言 镜头运动.pptx VIP
- 广州市白云区广大附中实验中学2022-2023学年上学期期中调研八年级物理问卷.docx VIP
- JB∕T 5317-2016 环链电动葫芦.pdf VIP
- 广东省广州市白云区广大附中实验中学2022-2023学年八年级上学期期末线上考试语文试卷.doc VIP
- 风电机组专项隐患排查治理记录表.doc VIP
- 风电机组专项隐患排查治理记录表自查.pdf VIP
- 工厂生产管理制度(3篇).docx VIP
文档评论(0)