摘要: 最近使用SparkSQL做数据的打平操作,就是把多个表的数据经过关联操作导入到一个表中,这样数据查询的过程中就不需要在多个表中查询了,在数据量大的情况下,这样大大提高了查询效率。 我启动了thriftserver,然后通过beeline去连接thriftserver, 打平操作进行的很顺利,但是在执 阅读全文
posted @ 2015-08-08 23:46 高兴的博客 阅读(2290) 评论(0) 推荐(0)
摘要: Sequoiadb作为一个文档型NoSQL数据既可以存储结构化数据也可以存储非结构化数据,对于非结构化数据只能使用原生的API进行查询,对结构化数据我们可以选择使用原生的API和开源SQL引擎,目前PostgresSQL,Hive,SparkSQL都可以作为Sequoiadb的SQL引擎,应用中该如 阅读全文
posted @ 2015-08-08 23:30 高兴的博客 阅读(1128) 评论(0) 推荐(0)