摘要:
urllib库urllib库是Python中最基本的网络请求库,可以模拟浏览器的行为,向指定的服务器发送一个请求,并可以保存服务器返回的数据注意:urllib是python自带的标准库,无需安装,直接可以用 一、基本函数详解 1.urlopen函数详解:创建一个表示远程url的类文件对象,然后像本地 阅读全文
posted @ 2021-03-03 23:02
马铃薯1
阅读(317)
评论(0)
推荐(0)
摘要:
什么是网络爬虫: 通俗的理解,爬虫是一个模拟人类请求网站行为的程序。可以自动请求网页、并把数据抓取下来, 然后使用一定的规则提取有价值的数据 为什么要用python写爬虫: 语法优美、代码简洁、开发效率高、支持的模块多。相关的HTTP请求模块和HTML解析模块非常丰富。 还有Scrapy和Scarp 阅读全文
posted @ 2021-03-03 19:55
马铃薯1
阅读(121)
评论(0)
推荐(0)

浙公网安备 33010602011771号