摘要: spider: import scrapyfrom yswPro.items import YswproItemfrom selenium import webdriverclass YswSpider(scrapy.Spider): name = 'ysw' # allowed_domains = 阅读全文
posted @ 2021-10-22 08:32 小毂 阅读(73) 评论(0) 推荐(0)
摘要: import requestsimport jsonif __name__ == '__main__': url = 'https://movie.douban.com/j/chart/top_list' headers = { 'User-Agent': 'Mozilla/5.0 (Windows 阅读全文
posted @ 2021-10-22 08:28 小毂 阅读(101) 评论(0) 推荐(0)
摘要: import requestsfrom lxml import etreeif __name__=='__main__': url = 'https://www.runoob.com/python3/python3-examples.html' headers = { 'User-Agent':'M 阅读全文
posted @ 2021-10-22 08:27 小毂 阅读(67) 评论(0) 推荐(0)
摘要: import requestsimport reimport xlwtif __name__=="__main__": wb = xlwt.Workbook() ws = wb.add_sheet('电影') url = 'https://maoyan.com/board/%d' headers = 阅读全文
posted @ 2021-10-22 08:26 小毂 阅读(51) 评论(0) 推荐(0)
摘要: import requestsimport xlwtfrom lxml import etreeif __name__=="__main__": wb = xlwt.Workbook() ws = wb.add_sheet('网站') url = 'https://www.hao123.com/' 阅读全文
posted @ 2021-10-22 08:25 小毂 阅读(59) 评论(3) 推荐(0)