跳到主要内容
CNode
查看回复

回复 (8)

N
nullcc#79 年前

爬虫前端多进程爬取,通过消息队列路由到后端,后端单DB起启动多个消费者接收处理数据并落地,在不是很大的并发量的情况下都可以扛住。

K
Kevinzhang29#69 年前
引用 as13579e分开来处理

@as13579e 好的看一下上面的老哥代码

K
Kevinzhang29#59 年前
引用 godghdai分而治之

@godghdai 谢谢

A
as13579e#39 年前

分开来处理

Y
Yuki-Minakami#29 年前

把获取url和爬取过程分离开 可以考虑用生产消费模型 配合async+多进程 这是我的一个例子,也是千万级别的请求数量 : ) https://github.com/Yuki-Minakami/PHelper

G
godghdai#19 年前

分而治之

参与回复

登录后即可参与回复。登录