技术宅,fat-man

增加语言的了解程度可以避免写出愚蠢的代码

导航

2014年3月27日 #

编码问题

摘要: 今天去听同事的网络爬虫的技术讲座。鄙人虽然不才也写过爬虫,也曾被一个点困扰过,就是处理汉字编码,于是就提了出来,这哥们回答的也挺好。首先是是使用python的库charet进行检测,先转成unicode,最后转成utf8格式,系统内部处理一律以utf8进行处理。进行检测我可以理解,内部一律以utf8... 阅读全文

posted @ 2014-03-27 17:45 codestyle 阅读(174) 评论(0) 推荐(0)