阿飞飞飞

学而时习之

导航

随笔分类 -  hadoop

hive——Error: Error while processing statement: FAILED: Execution Error, return code 1 from org.apache.hadoop.hive.ql.exec.DDLTask. MetaExcColumn length too big for column 'TYPE_NAME' (max = 21845)
摘要:工作太忙,隔了好久的HIVE没玩,捡起来重新学习下,建表出现错误如: Error: Error while processing statement: FAILED: Execution Error, return code 1 from org.apache.hadoop.hive.ql.exec 阅读全文

posted @ 2021-04-25 21:48 阿飞飞飞 阅读(4589) 评论(0) 推荐(0)

hive集成hbase——FAILED: Execution Error, return code 1 from org.apache.hadoop.hive.ql.exec.DDLTask错误的解决办法
摘要:问题:FAILED: Execution Error, return code 1 from org.apache.hadoop.hive.ql.exec.DDLTask 情景:将hbase内建的宽表映射到hive内,出现报错... 版本:使用的是hadoop三大版本中的CDH,hive:hive- 阅读全文

posted @ 2020-11-13 00:43 阿飞飞飞 阅读(2110) 评论(0) 推荐(0)

hive性能调优的几种方式
摘要:关于hive数据仓库的调优方式有很多种,留篇博客用来方便记忆... 1、设置本地模式 在hive0.7版本之后就开始支持任务执行选择本地模式(local mode),尽管hive是基于hadoop集群来做大数据处理的,但是有时会出现输入的数据量非常小,其查询出发执行任务的消耗时间远远大于job执行时 阅读全文

posted @ 2020-10-28 00:07 阿飞飞飞 阅读(833) 评论(0) 推荐(0)

org.apache.hadoop.security.AccessControlException: Permission denied: user=anonymous, access=EXECUTE——beeline 连接 hive 默认权限 anonymous用户权限不够
摘要:问题:beeline连接HIVE一直登录不上 原因:hiveserver2增加了权限控制 试着在hadoop的配置文件core-site.xml中加入以下配置,重启hadoop <property> <name>hadoop.proxyuser.hadoop.hosts</name> <value> 阅读全文

posted @ 2020-09-03 18:19 阿飞飞飞 阅读(1003) 评论(0) 推荐(0)

hive函数大全
摘要:在hive内部有许多函数,如下: 内置运算符 关系运算符 算术运算符 逻辑运算符 复杂类型函数 内置函数内置聚合函数 数学函数 收集函数 类型转换函数 日期函数 条件函数 字符函数 内置聚合函数 内置表生成函数 1.1关系运算符 1. 等值比较: = 2. 等值比较:<=> 3. 不等值比较: <> 阅读全文

posted @ 2020-08-29 22:16 阿飞飞飞 阅读(1526) 评论(0) 推荐(0)

hive的配置和HQL的查询优化
摘要:hive属于一种类SQL数据库 配置信息 pwd =>/opt/bigdata/hadoop/hive110/conf hive110/conf/hive-site.xml配置 <?xml version="1.0" encoding="UTF-8" standalone="no"?> <?xml- 阅读全文

posted @ 2020-08-29 15:11 阿飞飞飞 阅读(426) 评论(0) 推荐(0)

hadoop——高可用集群搭建的原理与方法
摘要:一、首先谈一谈zookeeper的选举机制 注:高可用集群中有两台机器作为namenode,无论在任何时候,集群中只能有一个namenode作为active状态,而另一个是standby状态,为了达到namenode快速容错的目的,引入zookeeper后,hadoop-ha可以在active的na 阅读全文

posted @ 2020-08-28 23:03 阿飞飞飞 阅读(946) 评论(0) 推荐(0)

Hadoop Combiner的三次测试...
摘要:当Client申请作业后,Resource Scheduler会进行调度,同时开启Map Task 和Reduce Task 测试一:mapper->reducer ##数据量<80Mb,在mapper端不设置combiner 若不设置combiner,经过map之后的文件数据将直接到达reduce 阅读全文

posted @ 2020-08-21 10:51 阿飞飞飞 阅读(198) 评论(0) 推荐(0)

关于Hadoop集群的配置方法——另附安装网址
摘要:hadoop-2.6.0.tar.gz(压缩包网址 https://archive.apache.org/dist/hadoop/common/hadoop-2.6.0/) 配置前需要配置主机名:vi etc/hosts ip loclhost ... 1、修改目录权限 chown -R root: 阅读全文

posted @ 2020-08-17 19:29 阿飞飞飞 阅读(477) 评论(0) 推荐(0)