随笔分类 -  hadoop

hadoop学习
摘要:namenode在内存和磁盘中都保存了fsimage和edits文件 内存中保证hdfs文件系统的访问效率,磁盘中保证hdfs文件系统的安全性 namenode的文件组成: fsimage文件:保存文件系统中直至上次checkpoint为止 的目录和文件元数据 edits文件:保存文件系统中直至上次 阅读全文
posted @ 2019-03-01 16:53 ccdh 阅读(340) 评论(0) 推荐(0)
摘要:(一)、hadoop的内置数据类型都实现了writablecompareable,以便序列化和网络传输及文件存储 a自定义数据类型作为输入 1.实现writable接口 2.如果给数据需要比较大小时,实现writablecompareable接口 b数据输入格式和recordreader 数据输入格 阅读全文
posted @ 2019-02-26 13:26 ccdh 阅读(677) 评论(0) 推荐(0)
摘要:集群的性能问题需要增加服务器节点以提高整体性能 https://www.cnblogs.com/fefjay/p/6048269.html hadoop集群之间hdfs文件复制 https://www.linuxidc.com/Linux/2017-09/146879.htm 阅读全文
posted @ 2019-02-25 17:03 ccdh 阅读(439) 评论(0) 推荐(0)
摘要:①自定义按某列排序,二次排序 writablecomparable中的compareto方法 ②topk a利用treemap,缺点:map中的key不允许重复:https://blog.csdn.net/u010660276/article/details/50967054 b封装mapper<k 阅读全文
posted @ 2019-02-25 15:09 ccdh 阅读(608) 评论(0) 推荐(0)
该文被密码保护。
posted @ 2018-01-15 09:55 ccdh 阅读(0) 评论(0) 推荐(0)
摘要:输入格式 1、输入分片与记录 2、文件输入 3、文本输入 4、二进制输入 5、多文件输入 6、数据库格式输入 详细的介绍:https://blog.csdn.net/py_123456/article/details/79766573 1、输入分片与记录 1、JobClient通过指定的输入文件的格 阅读全文
posted @ 2017-11-14 13:19 ccdh 阅读(1400) 评论(0) 推荐(0)
摘要:hadoop中的输入输出数据类型: BooleanWritable:标准布尔型数值 ByteWritable:单字节数值 DoubleWritable:双字节数值 FloatWritable:浮点数 常用的: IntWritable:整型数 LongWritable:长整型数 Text:使用UTF8 阅读全文
posted @ 2017-11-14 11:03 ccdh 阅读(498) 评论(0) 推荐(0)