摘要:
由于我Spark采用的是Hortonworks公司的HDP,安装的时候是使用Ambair做离线部署的。下面主要是介绍一下如何通过SparkSQL读取HIVE中的数据。 下面我主要介绍一下我使用的情况: 1、为了让Spark能够连接到Hive的原有数据仓库,我们需要将Hive中的hive-site.x 阅读全文
posted @ 2017-10-25 10:32
大葱拌豆腐
阅读(1217)
评论(0)
推荐(0)
摘要:
Hive是基于Hadoop的数据仓库工具,可对存储在HDFS上的文件中的数据集进行数据整理、特殊查询和分析处理,提供了类似于SQL语言的查询语言–HiveQL,可通过HQL语句实现简单的MR统计,Hive将HQL语句转换成MR任务进行执行。 一、概述 1-1 数据仓库概念 数据仓库(Data War 阅读全文
posted @ 2017-10-25 10:10
大葱拌豆腐
阅读(1821)
评论(0)
推荐(0)
浙公网安备 33010602011771号