摘要: 作者: 小橋流水 发表于 2010-07-20 15:15 原文链接 阅读: 415 评论: 3 1. 给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url? 方案1:可以估计每个文件安的大小为50G×64=320G,远远大于内存限制的4G。所以不可能将其完全加载到内存中处理。考虑采取分而治之的方法。 s 遍历文件a,对每个url求... 阅读全文
posted @ 2010-07-21 19:19 donj 阅读(188) 评论(0) 推荐(0) 编辑