随笔分类 -  python爬虫学习

摘要:之前我们使用的是python的自带的解析器html.parser。官网上面还有一些其余的解析器,我们分别学习一下。 1、python自带的 2、解析速度过得去 3、容错强 1、非常快 2、容错强 BeautifulSoup(markup,['lxml','xml']) BeautifulSoup(m 阅读全文
posted @ 2017-04-04 21:38 Sample1994 阅读(171) 评论(0) 推荐(0)
摘要:beautifulsoup是用于对爬下来的内容进行解析的工具,其find和find_all方法都很有用。并且按照其解析完之后,会形成树状结构,对于网页形成了类似于json格式的key - value这种样子,更容易并且更方便对于网页的内容进行操作。 下载库就不用多说,使用python的pip,直接在 阅读全文
posted @ 2017-04-04 13:37 Sample1994 阅读(262) 评论(0) 推荐(0)