赛迪网_IT门户_资讯中心_即时新闻赛迪网搜索专区:搜索引擎发展史回顾

来源:百度文库 编辑:神马文学网 时间:2024/03/28 22:40:19
赛迪网搜索专区:搜索引擎发展史回顾
作者:搜索引擎直通车 2005年04月04日 22:20 来源:搜索引擎直通车

[发表评论] [字体:大中小] [打印] [短信快递] [进入博客] [进入论坛] [推荐给朋友]

在互联网发展初期,网站相对较少,信息查找比较容易。然而伴随互联网爆炸性的发展,普通网络用户想找到所需的资料简直如同大海捞针,这时为满足大众信息检索需求的专业搜索网站便应运而生了。
现代意义上的搜索引擎的祖先,是1990年由蒙特利尔大学学生Alan Emtage发明的Archie。虽然当时World Wide Web还未出现,但网络中文件传输还是相当频繁的,而且由于大量的文件散布在各个分散的FTP主机中,查询起来非常不便,因此Alan Emtage想到了开发一个可以以文件名查找文件的系统,于是便有了Archie。
Archie工作原理与现在的搜索引擎已经很接近,它依靠脚本程序自动搜索网上的文件,然后对有关信息进行索引,供使用者以一定的表达式查询。由于Archie深受用户欢迎,受其启发,美国内华达System Computing Services大学于1993年开发了另一个与之非常相似的搜索工具,不过此时的搜索工具除了索引文件外,已能检索网页。
当时,“机器人”一词在编程者中十分流行。电脑“机器人”(Computer Robot)是指某个能以人类无法达到的速度不间断地执行某项任务的软件程序。由于专门用于检索信息的“机器人”程序象蜘蛛一样在网络间爬来爬去,因此,搜索引擎的“机器人”程序就被称为“蜘蛛”程序。
世界上第一个用于监测互联网发展规模的“机器人”程序是Matthew Gray开发的World wide Web Wanderer。刚开始它只用来统计互联网上的服务器数量,后来则发展为能够检索网站域名。
与Wanderer相对应,Martin Koster于1993年10月创建了ALIWEB,它是Archie的HTTP版本。ALIWEB不使用“机器人”程序,而是靠网站主动提交信息来建立自己的链接索引,类似于现在我们熟知的Yahoo。
随着互联网的迅速发展,使得检索所有新出现的网页变得越来越困难,因此,在Matthew Gray的Wanderer基础上,一些编程者将传统的“蜘蛛”程序工作原理作了些改进。其设想是,既然所有网页都可能有连向其他网站的链接,那么从跟踪一个网站的链接开始,就有可能检索整个互联网。到1993年底,一些基于此原理的搜索引擎开始纷纷涌现,其中以JumpStation、The World Wide Web Worm(Goto的前身,也就是今天Overture),和Repository-Based Software Engineering (RBSE) spider最负盛名。
然而JumpStation和WWW Worm只是以搜索工具在数据库中找到匹配信息的先后次序排列搜索结果,因此毫无信息关联度可言。而RBSE是第一个在搜索结果排列中引入关键字串匹配程度概念的引擎。
最早现代意义上的搜索引擎出现于1994年7月。当时Michael Mauldin将John Leavitt的蜘蛛程序接入到其索引程序中,创建了大家现在熟知的Lycos。同年4月,斯坦福(Stanford)大学的两名博士生,David Filo和美籍华人杨致远(Gerry Yang)共同创办了超级目录索引Yahoo,并成功地使搜索引擎的概念深入人心。从此搜索引擎进入了高速发展时期。目前,互联网上有名有姓的搜索引擎已达数百家,其检索的信息量也与从前不可同日而语。比如最近风头正劲的Google,其数据库中存放的网页已达30亿之巨!
随着互联网规模的急剧膨胀,一家搜索引擎光靠自己单打独斗已无法适应目前的市场状况,因此现在搜索引擎之间开始出现了分工协作,并有了专业的搜索引擎技术和搜索数据库服务提供商。象国外的Inktomi(已被Yahoo收购),它本身并不是直接面向用户的搜索引擎,但向包括Overture(原GoTo,已被Yahoo收购)、LookSmart、MSN、HotBot等在内的其他搜索引擎提供全文网页搜索服务。国内的百度也属于这一类(百度已于2001年9月开始提供公共搜索服务),搜狐和新浪用的就是它的技术(搜狐二级网页搜索现已改为中搜的引擎,而新浪则已转用Google的搜索结果)。因此从这个意义上说,它们是搜索引擎的搜索引擎。
_xyz
赛迪网_IT门户_资讯中心_即时新闻赛迪网搜索专区:搜索引擎发展史回顾 赛迪网_IT门户_资讯中心_即时新闻赛迪网搜索专区:搜索引擎三大主要类别简介 赛迪网_IT门户_资讯中心_即时新闻赛迪网搜索专区:了解搜索引擎基本工作原理 _技术天地_IT门户_赛迪网 雅虎收购Whereonearth 提高本地搜索能力 - 即时新闻 - 资讯中心 - 赛迪网 赛迪网_IT门户_技术天地_tech_ccidnet开发J2EE解决方案的八个步骤(2) - 赛迪网_IT门户_技术天地_tech_ccidnet语音互联再造Internet - 赛迪网_IT门户_技术天地_tech_ccidnetVPN:谁更需要你? - 赛迪网_IT门户_技术天地_tech_ccidnet用ANT构造Application - 赛迪网_IT门户_技术天地_tech_ccidnet教您快速上手使用JDOM处理XML文档的技巧 - 一六三搜索_领先的行业信息搜索引擎_心理咨询 _it业界_新浪网 (树) _it业界_新浪网 (表) 《商业2.0》评最佳非美国Web2.0 中国3家入选_资讯中心_IT人 http://ww... 细胞生物学发展史_ _饵料专区_ 搜索引擎发展史 李彦宏:不看好垂直搜索网站_李彦宏 百度 报道_搜索引擎_eNet硅谷动力资讯频道 大学英语四级六级高频词组回顾:第一天新沪江英语网_英语学习门户 现有搜索引擎很快过时 未来趋势走向个性化 _搜索_TechWeb 安全实例:僵尸网络模型分析及解决方案_评论分析_IT技术_IT专家网 Ilib搜索_自闭症 互联网上的“零距离”生活_IT数码_环球网 打造个性电脑桌面_i玩_媒体全文_IT门