01 2018 档案
day48-python爬虫学习三
摘要:Python的urllib和urllib2模块都做与请求URL相关的操作,但他们提供不同的功能。他们两个最显着的差异如下: urllib2可以接受一个Request对象,并以此可以来设置一个URL的headers,但是urllib只接收一个URL。这意味着,你不能伪装你的用户代理字符串等。 urll
阅读全文
day47-python爬虫学习二
摘要:2.Request的会话对象 s = requests.session() Python2 S = requests.Session() 所有一次会话的信息都保存在s中,只需要对s进行操作就可以了。 s.get(url) Requests通过会话信息来获取cookie信息 Cookie的五要素: N
阅读全文
day46-python爬虫学习
摘要:一、定义 网络爬虫(又被称为网页蜘蛛,网络机器人,在FOAF社区中间,更经常的称为网页追逐者),是一种按照一定的规则,自动地抓取万维网信息的程序或者脚本。另外一些不常使用的名字还有蚂蚁、自动索引、模拟程序或者蠕虫。 二、原理 爬虫是 模拟用户在浏览器或者App应用上的操作,把操作的过程、实现自动化的
阅读全文
day45-python实例练习
摘要:'''ABCD * 9 = DCBA 通过计算机的方法,给我们计算出 A= ? B = ? C = ? D =? A; 1-9 B: 1-9 C: 1-9 D; 1-9 A != B != C != D ''' 例子: class CountNumber(object): '''ABCD * 9 = DCBA ...
阅读全文
day44-Celery异步分布式
摘要:celery异步分布式Celery是一个python开发的异步分布式任务调度模块。Celery本身并不提供消息服务,使用第三方服务,也就是borker来传递任务,目前支持rebbimq,redis, 数据库等。 这里我们使用redis连接url的格式为:redis://:password@hostn
阅读全文
浙公网安备 33010602011771号