06 2021 档案

摘要:上一个新浪微博的例子比较简单,现在我们来看一个汽车之家的例子 还和之前一样,我们需要先导包然后定义url和请求头 import requests from bs4 import BeautifulSoup #定义url和请求头 url = 'https://www.autohome.com.cn/n 阅读全文
posted @ 2021-06-16 16:36 kannei 阅读(97) 评论(0) 推荐(1)
摘要:今天我们想要提取一下新网微博热搜的题目和热度 利用之前我们所学的知识,今天这个问题应该不难解决 我直接展示一下代码,代码里的注释大家可以看一下: import requests from bs4 import BeautifulSoup #定义url和请求头 url = 'https://s.wei 阅读全文
posted @ 2021-06-16 15:18 kannei 阅读(64) 评论(0) 推荐(0)
摘要:之前我们是用lxml来提取数据,今天我们来学习一下bs4 在学习之前呢我们需要先来安装一下包 pip install bs4 我们用到的例子还是上节课的text内容 text = \ """ <ul class="ullist" padding="1" spacing="1"> <li> <div 阅读全文
posted @ 2021-06-15 17:19 kannei 阅读(77) 评论(0) 推荐(0)
摘要:我们好久不见~ 来更新博客啦!最近在学爬虫,scrapy学不下去了,有点难搞啊,学点简单的吧哈哈哈哈 好啦,开始今天的分享~ 首先得安装lxml库,pip install lxml 我们使用lxml库对html这样的字符串进行解析,将它还原为一个HTML页面,换句话说,Python里面的lxml库只 阅读全文
posted @ 2021-06-13 19:45 kannei 阅读(486) 评论(0) 推荐(0)