摘要: Hadoop演进: 1.Hadoop最早起源于Nutch。Nutch的设计目标是构建一个大型的全网搜索引擎,包括网页抓取、索引、查询等功能,但随着抓取网页数量的增加,遇到了严重的可扩展性问题——如何解决数十亿网页的存储和索引问题。 2.2003年、2004年谷歌发表的两篇论文为该问题提供了可行的解决 阅读全文
posted @ 2020-09-18 10:50 落幕无华 阅读(272) 评论(0) 推荐(0) 编辑