- 1、本文档共8页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
基于Lucene的图书搜索引擎的设计与实现 外文文献
滨江学院
毕业论文(设计)
外文翻译
题目 基于Lucene的图书搜索引擎
学生姓名
学 号
院 系 滨江学院计算机系
专 业 软件工程
指导教师
二O一一年 四 月二十八日
理解Lucene
不同的人用不同的途径讨论同一个问题-――信息超载。其中一些致力于研究新型的用户界面,另一些研究智能代理,其他的则研究搜索工具Lucene是什么Lucene是一种高性能,可扩展的信息检索的资料库。索引和搜索能力Lucene是一款基于Java语言成熟的,免费开源的项目它属于流行的Apache Jakarta项目下的一个分支并Apache软件许可证。因此, Lucene目前已成为几年最热门的免费Java很快就会发现,Lucene提供了一个既简单又强大的核心的API需要对全文索引和搜索能力的认识需要了解少数以开始整合成为一个Lucene的应用。由于Lucene的是一个Java的资料库,它没有对索引和搜寻作出有关的假设赋予它的优势,超过了一些其他的搜索应用程序。这不是真正的Lucene: Lucene是一个软件库,一个工具包,但它并不是一个功能齐全的搜索应用软件。它与全文索引和搜索相关Lucene让您的应用程序处理业务规则,与相关领域有关,而隐藏在复杂的索引和搜索执行的背后是简单易用的API 。你可以把Lucene作为一个描成1.5中,在顶层的软件层。功能齐全的搜索应用程序如果您在寻找一些编译好的核心套件或一个框架,用于抓寻找文件处理,搜索,Lucene的Wiki上的“动力”网页( /jakarta-lucene/poweredby )对于许多选项: zilverline , searchblox , nutch , larm , jsearch 仅举几例。案例研究双方的nutch和searchblox是包括在第10章。Lucene能为您做什么
Lucene可以让你把索引和搜索功能添加到您的应用程序(这些 )Lucene可以索引和搜索可以转换为文本格式的数据。你可以在图1.5 。Lucene的不关心数据的来源,它的格式,甚至是它的语言,只要您可以转换为文本。这意味着您可以使用Lucene的索引和搜索的数据储存在档案:网页上的远程Web服务器,文件存储在本地文件系统,简单的文本文件, Microsoft Word文件, HTML或PDF档案,或任何其他从中可以提取的文字信息的格式。同样地,在Lucene的帮助下,您可以把数据储存在您的数据库,让您的用户拥有许多数据库不提供的全文搜索的能力一旦你集成Lucene,您的程序用户申请可以搜索,如+乔治+水稻即食-布丁,苹果馅饼+老虎,动物:猴子及食物:香蕉,等等。对于Lucene,你可以索引和搜索电子邮件,邮件列表归档,即时信使聊天室,您的wiki网页… ,不胜枚举。Lucene的历史
Lucene的原本的书是由Doug Cutting著的,它最初是可供下载其主页在SourceForge的网站。2001年9月它加入了Apache软件基金会的Jakarta系列Java的产品的高品质的开放源代码。自那时以来的每个版本,该项目已得到了提高知名度,吸引更多的用户和开发商。截至2004年7月, Lucene的1.4与一个在10月初bug修复1.4.2版已经发布。表1.1表明, Lucene的的发布历史。
版本 发布日期 里程碑 0.01 2000年3月 首次发布开放资源(代码运行稳定) 1.0 200年10月 ? 1.01b 2001年6月 最终源代码稳定发布 1.2 2002年6月 Apache Jakarta第一版发布 1.3 2003年12月 复合索引格式,查询分析器增强,远程搜索,象征性的定位API 1.4 2004年7月 整理,跨度疑问,任期载体 1.4.1 2004年8月 错误修复清理 1.4.2 2004年10月 指数搜索优化和misc.fixes 1.4.3 2004年冬季 Misc.fixes ?
表1.1
备注: Lucene的创始人,Doug Cutting,在IR领域具有重大的理论和实践经验他出版了一系列研究论文和各种关于IR主题的论文并为各公司工作,如Excite, Apple, 和Grand Central 。最近,网络搜索引擎和在这一领域,他创造了nutch ,第一开放源代码搜索世界各地的网络搜索引擎( ) ; 它为处理检索而设计,索引和搜索数十亿经常更新的网页。毫不奇怪, Lucene的核心是nutch ; 10.1节,包括研究nutch如何利用Lucene。Doug
文档评论(0)