会员
周边
新闻
博问
闪存
众包
赞助商
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
Chevalier
十步杀一人,千里不留行
博客园
首页
联系
订阅
管理
随笔分类 -
搜索引擎
海量数据面试题整理【转】
摘要:作者:小橋流水 来源:博客园 时间:2010-07-20 阅读:149 次 原文链接 [收藏]1. 给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url?方案1:可以估计每个文件安的大小为50G×64=320G,远远大于内存限制的4G。所以不可能将其完全加载到内存中处理。考虑采取分而治之的方法。s 遍历文件a,对每个url求取...
阅读全文
posted @
2010-07-24 11:21
Chevalier
阅读(350)
评论(0)
推荐(0)
公告