会员
众包
新闻
博问
闪存
赞助商
HarmonyOS
Chat2DB
所有博客
当前博客
我的博客
我的园子
账号设置
会员中心
简洁模式
...
退出登录
注册
登录
哥不是小萝莉
博客园
首页
新随笔
联系
订阅
管理
上一页
1
···
7
8
9
10
11
12
13
14
15
···
21
下一页
2017年12月10日
HBase存储剖析与数据迁移
摘要: 1.概述 HBase的存储结构和关系型数据库不一样,HBase面向半结构化数据进行存储。所以,对于结构化的SQL语言查询,HBase自身并没有接口支持。在大数据应用中,虽然也有SQL查询引擎可以查询HBase,比如Phoenix、Drill这类。但是阅读这类SQL查询引擎的底层实现,依然是调用了HB
阅读全文
posted @ 2017-12-10 12:21 哥不是小萝莉
阅读(3871)
评论(0)
推荐(2)
2017年11月11日
HBase流量限制和表负载均衡剖析
摘要: 1.概述 在HBase-1.1.0之前,HBase集群中资源都是全量的。用户、表这些都是没有限制的,看似完美实则隐患较大。今天,笔者就给大家剖析一下HBase的流量限制和表的负载均衡。 2.内容 也许有同学有疑问,为啥要做流量限制,无限制全量跑不是更好吗?举个例子,比如今天的双十一日,数据流量是非常
阅读全文
posted @ 2017-11-11 20:55 哥不是小萝莉
阅读(5305)
评论(0)
推荐(3)
2017年10月15日
Zeppelin源码
摘要: 1.概述 在大数据应用场景中,处理数据分析方面,由于开发者的水平不一样,使用的编程语言也不尽相同,可能会涉及到R、Python、Java、Scala等,数据计算模型也估计不一样,可能涉及的有Spark、Hive、Flink、Kylin等等。本篇博客笔者给大家介绍的内容并不是告诉大家如何去使用。在《Z
阅读全文
posted @ 2017-10-15 03:26 哥不是小萝莉
阅读(5144)
评论(2)
推荐(4)
2017年9月14日
Kafka Streams 剖析
摘要: 1.概述 Kafka Streams 是一个用来处理流式数据的库,属于Java类库,它并不是一个流处理框架,和Storm,Spark Streaming这类流处理框架是明显不一样的。那这样一个库是做什么的,能应用到哪些场合,如何使用。笔者今天就给大家来一一剖析这些内容。 2.内容 首先,我们研究这样
阅读全文
posted @ 2017-09-14 11:10 哥不是小萝莉
阅读(7234)
评论(0)
推荐(1)
2017年8月9日
Kafka 存储机制和副本
摘要: 1.概述 Kafka 快速稳定的发展,得到越来越多开发者和使用者的青睐。它的流行得益于它底层的设计和操作简单,存储系统高效,以及充分利用磁盘顺序读写等特性,和其实时在线的业务场景。对于Kafka来说,它是一个分布式的,可分区的,多副本,多订阅者的,基于Zookeeper统一协调的分布式日志系统。常见
阅读全文
posted @ 2017-08-09 16:19 哥不是小萝莉
阅读(2853)
评论(2)
推荐(2)
2017年7月16日
分布式系统选举算法剖析
摘要: 1.概述 我们在了解分布式选举算法之前,我们需要这样一种算法产生的背景。在一个分布式系统中,因为各种意外的因素,有的服务器可能会崩溃或变得不可靠,它就不能和其他服务器达成一致状态。因而这样就需要一种Consensus协议,来确保服务器的容错性,也就是说即使系统中有一两个服务器节点Crash,也不会影
阅读全文
posted @ 2017-07-16 13:37 哥不是小萝莉
阅读(8558)
评论(0)
推荐(1)
2017年6月10日
Elasticsearch 与 Kafka 整合剖析
摘要: 1.概述 目前,随着大数据的浪潮,Kafka 被越来越多的企业所认可,如今的Kafka已发展到0.10.x,其优秀的特性也带给我们解决实际业务的方案。对于数据分流来说,既可以分流到离线存储平台(HDFS),离线计算平台(Hive仓库),也可以分流实时流水计算(Storm,Spark)等,同样也可以分
阅读全文
posted @ 2017-06-10 14:19 哥不是小萝莉
阅读(24161)
评论(1)
推荐(4)
2017年5月6日
Kafka 源码剖析
摘要: 1.概述 在对Kafka使用层面掌握后,进一步提升分析其源码是极有必要的。纵观Kafka源码工程结构,不算太复杂,代码量也不算大。分析研究其实现细节难度不算太大。今天笔者给大家分析的是其核心处理模块,core模块。 2.内容 首先,我们需要对Kafka的工程结构有一个整体的认知度,Kafka 大家最
阅读全文
posted @ 2017-05-06 18:14 哥不是小萝莉
阅读(19122)
评论(1)
推荐(2)
2017年4月9日
Apache Beam 剖析
摘要: 1.概述 在大数据的浪潮之下,技术的更新迭代十分频繁。受技术开源的影响,大数据开发者提供了十分丰富的工具。但也因为如此,增加了开发者选择合适工具的难度。在大数据处理一些问题的时候,往往使用的技术是多样化的。这完全取决于业务需求,比如进行批处理的MapReduce,实时流处理的Flink,以及SQL交
阅读全文
posted @ 2017-04-09 16:14 哥不是小萝莉
阅读(14361)
评论(0)
推荐(1)
2017年3月7日
Kafka Eagle 源码解读
摘要: 1.概述 在《Kafka 消息监控 - Kafka Eagle》一文中,简单的介绍了 Kafka Eagle这款监控工具的作用,截图预览,以及使用详情。今天笔者通过其源码来解读实现细节。目前该项目已托管于 Github 之上,作者编写了使用手册,告知使用者如何安装,部署,启动该系统。但对于实现的细节
阅读全文
posted @ 2017-03-07 10:56 哥不是小萝莉
阅读(5465)
评论(17)
推荐(4)
上一页
1
···
7
8
9
10
11
12
13
14
15
···
21
下一页
公告