当前网页请求流量比较大,第一打开部分内容没有加载出来
请刷新前网页 加载一次或多次ヾ(≧O≦)〃嗷~
温馨提示: 此网页不兼容ie浏览器, 关闭qq、360等浏览器的ie模式

11 2021 档案

摘要:scrapy_电影天堂多页数据和图片下载嵌套的 爬取 先获取第一页的标题 点击标题到第二页的图片url 1、创建项目 > scrapy startproject scrapy_movie_099 2、创建爬虫文件 spiders>scrapy genspider mv https: //www.dytt8.net/html/gndy/ch 阅读全文
posted @ 2021-11-17 12:01 ⎛⎝秋泊君⎠⎞ 阅读(113) 评论(0) 推荐(0)
摘要:scrapy获取当当网多页的获取结合上节,网多页的获取只需要修改 dang.py import scrapy from scrapy_dangdang.items import ScrapyDangdang095Item class DangSpider(scrapy.Spider): name = 'dang' # 如果是多页下 阅读全文
posted @ 2021-11-16 11:34 ⎛⎝秋泊君⎠⎞ 阅读(317) 评论(0) 推荐(0)
摘要:scrapy获取当当网中数据yield 1. 带有 yield 的函数不再是一个普通函数,而是一个生成器generator,可用于迭代 2. yield 是一个类似 return 的关键字,迭代一次遇到yield时就返回yield后面(右边)的值。重点是:下一次迭代时,从上一次迭代遇到的yield后面的代码(下一行)开始执行 阅读全文
posted @ 2021-11-15 23:37 ⎛⎝秋泊君⎠⎞ 阅读(255) 评论(0) 推荐(0)
摘要:scrapy获取58同城数据1. scrapy项目的结构 项目名字 项目名字 spiders文件夹 (存储的是爬虫文件) init 自定义的爬虫文件 核心功能文件 **************** init items 定义数据结构的地方 爬取的数据都包含哪些 middleware 中间件 代理 pipelines 管道 用来 阅读全文
posted @ 2021-11-13 16:14 ⎛⎝秋泊君⎠⎞ 阅读(198) 评论(0) 推荐(0)
摘要:scrapy的安装,scrapy创建项目简要: scrapy的安装 # 1)pip install scrapy -i https://pypi.douban.com/simple(国内源) 一步到位 # 2) 报错1: building 'twisted.test.raiser' extension # error: Microsoft 阅读全文
posted @ 2021-11-13 16:13 ⎛⎝秋泊君⎠⎞ 阅读(106) 评论(0) 推荐(0)
摘要:selenium基本使用,及cannot find chrome binary解决方案什么是selenium? Selenium是一个用于Web应用程序测试的工具。 Selenium 测试直接运行在浏览器中,就像真正的用户在操作一样。 支持通过各种driver(FirfoxDriver,IternetExplorerDriver,OperaDriver,ChromeDriver)驱动 阅读全文
posted @ 2021-11-08 19:49 ⎛⎝秋泊君⎠⎞ 阅读(615) 评论(0) 推荐(0)