登录 |  注册 |  繁體中文

人工智能&大数据
2014-10-28 16:05:00
三台服务器,每台的作用如下: 192.168.1.1 NameNode SecondaryNameNode ResourceManager HMaster HQuorumPeer 192.168.1.2 DataNode NodeManager HRegionServer HQuorumPeer 192.168.1.3 DataNode NodeManager HRegionServer H
2013-11-25 17:52:58
题一、 给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url? 方案1:可以估计每个文件安的大小为50G×64=320G,远远大于内存限制的4G。所以不可能将其完全加载到内存中处理。考虑采取分而治之的方法。 1) 遍历文件a,对每个url求取hash(url)%1000,然后根据所取得的值将url分别存储到1000个小文件(记为a0…&
7页/总7页  共74条记录  首页 上一页 下一页 尾页

回到顶部