Spark日志清洗

   日志数据清洗,主要采用spark 的定时任务,清洗出有效数据,并保存到hive数据仓库中存储。常用流程如下:

参考:https://gaojianhua.gitbooks.io/bigdata-wiki/content/sparkclean.html

posted @ 2017-05-07 20:54  moonandstar08  阅读(1564)  评论(0编辑  收藏  举报