05 2018 档案

摘要:1.用Hive对爬虫大作业产生的文本文件(或者英文词频统计下载的英文长篇小说)词频统计。 2.用Hive对爬虫大作业产生的csv文件进行数据分析,写一篇博客描述你的分析过程和分析结果。 阅读全文
posted @ 2018-05-25 19:34 050朱小彬 阅读(86) 评论(0) 推荐(0)
摘要:通过hadoop上的hive完成WordCount 启动hadoop start-all.sh Hdfs上创建文件夹 hdfs dfs -mkdir wcinput hdfs dfs -ls /user/hadoop 上传文件至hdfs hdfs dfs -put ./1.txt wcinput h 阅读全文
posted @ 2018-05-16 15:14 050朱小彬 阅读(100) 评论(0) 推荐(0)
摘要:用mapreduce 处理气象数据集 编写程序求每日最高最低气温,区间最高最低气温 阅读全文
posted @ 2018-05-09 21:43 050朱小彬 阅读(121) 评论(0) 推荐(0)
摘要:1. 以下关系型数据库中的表和数据,要求将其转换为适合于HBase存储的表并插入数据: 学生表(Student)(不包括最后一列) 学号(S_No) 姓名(S_Name) 性别(S_Sex) 年龄(S_Age) 课程(course) 2015001 Zhangsan male 23 2015003 阅读全文
posted @ 2018-05-08 21:52 050朱小彬 阅读(111) 评论(0) 推荐(0)