YARN基础架构

  Yarn是一个资源调度平台,负责为运算程序提供服务器运算资源,相当于一个分布式的操作系统平台,而MapReduce等运算程序则相当于运行于操作系统之上的应用程序。

 

1. Yarn基础架构

  YARN主要由ResourceManagerNodeManagerApplicationMasterContainer等组件构成。

 

 

 

2. YARN工作机制

1MR程序提交到客户端所在的节点。

2YarnRunnerResourceManager申请一个Application

3RM将该应用程序的资源路径返回给YarnRunner。

4)该程序将运行所需资源提交到HDFS

5)程序资源提交完毕后,申请运行mrAppMaster。

6RM将用户的请求初始化成一个Task。

7)其中一个NodeManager领取Task任务。

8)该NodeManager创建容器Container并产生MRAppmaster。

9ContainerHDFS上拷贝资源到本地

10MRAppmaster向RM 申请运行MapTask资源。

11RM运行MapTask任务分配给另外两个NodeManager,另两个NodeManager分别领取任务创建容器。

12MR向两个接收到任务的NodeManager发送程序启动脚本这两个NodeManager分别启动MapTask,MapTask对数据分区排序。

13MrAppMaster等待所有MapTask运行完毕后,向RM申请容器,运行ReduceTask。

14ReduceTaskMapTask获取相应分区的数据。

15)程序运行完毕后,MR会向RM申请注销自己。

 

 

posted @ 2022-07-27 19:27  小王同学学编程  阅读(58)  评论(0)    收藏  举报
levels of contents