- 链接地址:https://blog.csdn.net/qq_28609735/article/details/100122841
- 链接标题:两个超大文件求交集_两个大文件,每行一个字符串,找交集-CSDN博客
- 所属网站:blog.csdn.net
- 被收藏次数:6350
题目背景给定a、b两个文件,各存放50亿个url,每个url各占64字节,内存限制是4G,让你找出a、b文件共同的url主体思路分治+hash实现步骤遍历文件A,对每个url使用hash(url) % 1000,根据所得的取值将url存储到1000个小文件中(a1,a2,…,a1000)(根据内存大小设定hash函数)遍历文件B,使用同样的hash函数将B中的url存储到1000个小文..._两个大文件,每行一个字符串,找交集
版权声明:本文发布于特牛网址导航 内容均来源于互联网 如有侵权联系删除