import requests
import re
import xlwt
if __name__=="__main__":
wb = xlwt.Workbook()
ws = wb.add_sheet('电影')
url = 'https://maoyan.com/board/%d'
headers = {
'User-Agent': 'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/94.0.4606.71 Safari/537.36 Edg/94.0.992.38'
}
ws.write(0, 1, "电影名称")
ws.write(0, 2, "演员")
ws.write(0, 3, "上映时间")
list = [1,2,4,6,7]
for i in list:
new_url = format(url%i)
response = requests.get(url=new_url,headers=headers).text
ex = '<p class="name">.*?>(.*?)</a></p>'
ez = '<p class="star">(.*?)</p>'
eq = '<p class="releasetime">(.*?)</p>'
title_list = re.findall(ex,response,re.S)
content1 = re.findall(ez,response,re.S)
content2 = re.findall(eq,response,re.S)
w = 0
q = 0
for j in title_list:
ws.write(w+1,0,w+1)
ws.write(q+1,1,j)
w += 1
q += 1
print(j)
q = 0
for k in content1:
ws.write(w + 1, 0, w + 1)
ws.write(q+1,2,k)
w += 1
q += 1
print(k)
q = 0
for l in content2:
ws.write(w + 1, 0, w + 1)
ws.write(q+1,3,l)
w += 1
q += 1
print(l)
wb.save('电影周刊.xls')