摘要:
在ajax横行的年代,很多网页的内容都是动态加载的,而我们的小爬虫抓取的仅仅是web服务器返回给我们的html,这其中就跳过了js加载的部分,也就是说爬虫抓取的网页是残缺的,不完整的,下面可以看下博客园首页从首页加载中我们看到,在页面呈现后,还会有5个ajax异步请求,在默认的情况下,爬虫是抓... 阅读全文
posted @ 2016-01-04 18:40
xxxxxxxx1x2xxxxxxx
阅读(2436)
评论(0)
推荐(0)
浙公网安备 33010602011771号