gpt4 book ai didi

mysql - 分布式爬虫和一致性

转载 作者:可可西里 更新时间:2023-11-01 11:12:22 24 4
gpt4 key购买 nike

情况是我们有多个服务器(40 多台)同时抓取一个相同的 URL(以确保我们有最小的遗留)并将数据保存到数据库(MySQL)中。

现在的问题是:数据来回切换。例如,由于爬虫/数据库的遗留问题,内容将在几秒钟内变为 A <-> B <-> A <-> B <-> A。

有什么好的方法可以预防吗?我们正在用 Perl 编写爬虫,但任何语言都适合我们,因为我们可以借鉴背后的想法。

任何提示将不胜感激。雷迪斯? ZeroMQ?

谢谢

最佳答案

关于mysql - 分布式爬虫和一致性,我们在Stack Overflow上找到一个类似的问题: https://stackoverflow.com/questions/56445790/

24 4 0
Copyright 2021 - 2024 cfsdn All Rights Reserved 蜀ICP备2022000587号
广告合作:1813099741@qq.com 6ren.com