11 2017 档案

摘要:高级方法 apply() apply()是一个非常常用并且好用的方法,它允许我们自定义一个函数并且应用到我们的数据中。 比如我们现在有这样的需求,求出每一列数据的最大值与最小值的差,可以这样使用。 默认情况,是以0轴方向应用的这个函数,但是我们可以指定1轴,这时候,我们求得就是每一行的最大值与最小值 阅读全文
posted @ 2017-11-10 23:56 cnkai 阅读(244) 评论(0) 推荐(0)
摘要:axis=0代表跨行(down),而axis=1代表跨列(across) 使用0值表示沿着每一列或行标签\索引值向下执行方法 使用1值表示沿着每一行或者列标签模向执行对应的方法 下图代表在DataFrame当中axis为0和1时分别代表的含义: axis参数作用方向图示 另外,Pandas保持了Nu 阅读全文
posted @ 2017-11-10 23:56 cnkai 阅读(679) 评论(0) 推荐(0)
摘要:前段时间,我们爬取了几部热门的电影,分别是《三生三世》,《战狼》,《二十二》,我们今天 就以这几部为例,进行一个简单的词云的制作。 我们主要以《二十二》为例,来制作一个评论的词云。 首先需要安装几个必要的工具库: Pandas 用来实现文件读取和存储,以及必要的数据转换。 jieba 一个强大的分词 阅读全文
posted @ 2017-11-08 21:52 cnkai 阅读(753) 评论(0) 推荐(0)
摘要:针对抓取到的南京市链家网的房源数据进行一次简单的数据可视化 首先导入必要的库。 读取链家网房源数据的csv文件。 原文件中有每一个房源的链接信息,在这里我们不需要,所以就可以直接删除。 上面表格中的列分别是南京市的行政区划,房源名称,房屋设置,面积,朝向,装修情况的描述,电梯与否,楼层高度,建造时间 阅读全文
posted @ 2017-11-08 15:14 cnkai 阅读(1519) 评论(0) 推荐(2)