会员
周边
新闻
博问
AI培训
云市场
所有博客
当前博客
我的博客
我的园子
账号设置
简洁模式
...
退出登录
注册
登录
奇怪的读书人
博客园
首页
新随笔
联系
订阅
管理
2021年10月26日
4
摘要: 1、Hadoop最早起源于lucene下的Nutch。Nutch的设计目标是构建一个大型的全网搜索引擎,包括网页抓取、索引、查询等功能,但随着抓取网页数量的增加,遇到了严重的可扩展性问题——如何解决数十亿网页的存储和索引问题。2、2003年、2004年谷歌发表的三篇论文为该问题提供了可行的解决方案。
阅读全文
posted @ 2021-10-26 15:54 奇怪的读书人
阅读(5)
评论(0)
推荐(0)
编辑
公告