摘要:
越写越像官方文档的翻译,偏离了初衷。写一些官方文档里没有的内容吧。 在不限制宽带的环境下,根据页面的大小, Scrapy 一秒能爬取40-70个页面,一天在400万到600万页面。也就是说 Scrapy 应付千万级或者亿级的爬取没有问题。 Scrapy 主要限制是select函数,在其他方面优化完美的情况下,大概有60%-70%的CPU花费在select上,剩下10%花费在框... 阅读全文
posted @ 2014-03-17 22:15
阿健后院
阅读(5502)
评论(2)
推荐(1)
浙公网安备 33010602011771号