09 2016 档案

spider学习

摘要：引擎(Scrapy)用来处理整个系统的数据流处理, 触发事务(框架核心) 调度器(Scheduler)用来接受引擎发过来的请求, 压入队列中, 并在引擎再次请求的时候返回. 可以想像成一个URL（抓取网页的网址或者说是链接）的优先队列, 由它来决定下一个要抓取的网址是什么, 同时去除重复的网址下载阅读全文

posted @ 2016-09-01 08:58 云天明阅读(182) 评论(0) 推荐(0)

云天明

09 2016 档案

公告