文章分类 -  search

摘要:使用SQL SERVER 2000的全文检索功能 选择自 lihonggen0 的 Blog 步骤: 1、 打开NorthWind数据库,右键Products表,选择“全文索引表”,“在表上定义全文索引”,为其创建全文目录。在“全文索引向导”中,选择你需要全文查询条件的列(可以是文本或图像),我... 阅读全文
posted @ 2006-04-04 18:39 torome 阅读(205) 评论(0) 推荐(0)
摘要:DotLucene是一个强有力的开源全文搜索引擎,它是从Apache的Lucene(java)项目移植到.Net(C#)上的。 DotLucene的效率非常高,并且还具有对搜索结果评级、高光、搜索非结构数据以及本地化等特点。它还和Lucene的索引兼容,因此你可以在不同的平台间迁移而不会丢失任何... 阅读全文
posted @ 2006-03-31 19:06 torome 阅读(434) 评论(1) 推荐(0)
摘要:大家都知道Lucene.net变节后改为商业,我是开源热爱分子,容不得在没有考虑现有用户的情况下把开源改为商业的行径,最恶心的是连旧版本的源代码都干掉了。幸好,有DotLucene的出现,开发人员不断推出新版本,每次新版本都包含无数的新功能和错误修正。现在已经推出到1.9 RC 001版本了。要体验... 阅读全文
posted @ 2006-03-31 18:59 torome 阅读(578) 评论(0) 推荐(0)
摘要:搜索引擎的实现原理,可以看作四步:从互联网上抓取网页→建立索引数据库→在索引数据库中搜索→对搜索结果进行处理和排序。 从互联网上抓取网页. 利用能够从互联网上自动收集网页的网络蜘蛛程序,自动访问互联网,并沿着任何网页中的所有URL爬到其它网页,重复这过程,并把爬过的所有网页收集到服务器中。... 阅读全文
posted @ 2006-03-31 18:57 torome 阅读(450) 评论(0) 推荐(0)
摘要:DotLucene的 官方网站这样介绍:DotLucene是一个专门为NET设计的功能强大的搜索引擎!他上面也有一个在线demo,搜索3.5GB的文本数据所花费的时间在0.1秒左右!大家可以点 这里测试。我也记得在我的一个网站 99收藏夹(注1)里面有个在线帮助,他是用StreamReader来... 阅读全文
posted @ 2006-03-31 18:57 torome 阅读(337) 评论(0) 推荐(0)
摘要:99收藏夹原来的站内收藏搜索是基于数据库的like%%语句,发现速度有点慢,于是想到用Lucene来实现站内收藏的按名字和共享收藏的连接标题来搜索的功能,昨天下午做好了,但是结果有点牵强人意。首先我用Lucene把数据从数据库导出建立索引,代码如下,注:里面的ChinaTokene方法是调用www.... 阅读全文
posted @ 2006-03-31 18:56 torome 阅读(300) 评论(0) 推荐(0)
摘要:在上篇文章我们说了怎么建立索引,现在说的是怎么搜索这个索引,最主要的我们是要理解startAt的含义,理解了他什么问题都解决了。还有这个例子的分页很经典,我发现google和baidu用的都是这个分页方法。主要就两个方法,一个search()方法,主要是显示当前页的搜索记录 1 protecte... 阅读全文
posted @ 2006-03-31 18:55 torome 阅读(185) 评论(0) 推荐(0)