判断爬取到页面的编码类型
一个很有趣的个人博客,不信你来撩 fangzengye.com
1 #如果你的python没有安装chardet模块,你需要首先安装一下chardet判断编码的模块哦
2 #author:pythontab.com
3 import chardet
4 import urllib
5 #先获取网页内容
6 data1 = urllib.urlopen('http://www.baidu.com').read()
7 #用chardet进行内容分析
8 chardit1 = chardet.detect(data1)
9
10 print chardit1['encoding'] # baidu
我的个人博客fangzengye.com, 欢迎来撩哦!
原文博主: 热衷开源的宝藏Boy
版权声明: 自由转载-非商用-禁止演绎-保持署名| CC BY-NC-ND 3.0
浙公网安备 33010602011771号