原文:Apache Spark源码走读之15 -- Standalone部署模式下的容错性分析

欢迎转载,转载请注明出处,徽沪一郎。 概要 本文就standalone部署方式下的容错性问题做比较细致的分析,主要回答standalone部署方式下的包含哪些主要节点,当某一类节点出现问题时,系统是如何处理的。 Standalone部署的节点组成 介绍Spark的资料中对于RDD这个概念涉及的比较多,但对于RDD如何运行起来,如何对应到进程和线程的,着墨的不是很多。 在实际的生产环境中,Spark ...

2014-06-17 21:51 2 3415 推荐指数:

查看详情

Apache Spark源码走读之7 -- Standalone部署方式分析

欢迎转载,转载请注明出处,徽沪一郎。 楔子 在Spark源码走读系列之2中曾经提到Spark能以Standalone的方式来运行cluster,但没有对Application的提交与具体运行流程做详细的分析,本文就这些问题做一个比较详细的分析,并且对在standalone模式如何实现HA进行 ...

Mon May 12 20:09:00 CST 2014 0 6804
Apache Spark源码走读之19 -- standalone cluster模式资源的申请与释放

欢迎转载,转载请注明出处,徽沪一郎。 概要 本文主要讲述在standalone cluster部署模式Spark Application在整个运行期间,资源(主要是cpu core和内存)的申请与释放。 构成Standalone cluster部署模式的四大组成部件如下图所示,分别为 ...

Tue Jul 22 07:36:00 CST 2014 0 2758
Apache Spark源码走读之9 -- Spark源码编译

欢迎转载,转载请注明出处,徽沪一郎。 概要 本来源码编译没有什么可说的,对于java项目来说,只要会点maven或ant的简单命令,依葫芦画瓢,一子就ok了。但到了Spark上面,事情似乎不这么简单,按照spark officical document上的来做,总会出现这样或那样的编译 ...

Sat May 17 00:44:00 CST 2014 4 5352
Apache Spark源码走读之6 -- 存储子系统分析

欢迎转载,转载请注明出处,徽沪一郎。 楔子 Spark计算速度远胜于Hadoop的原因之一就在于中间结果是缓存在内存而不是直接写入到disk,本文尝试分析Spark中存储子系统的构成,并以数据写入和数据读取为例,讲述清楚存储子系统中各部件的交互关系。 存储子系统概览 上图是Spark ...

Thu May 08 21:37:00 CST 2014 2 5501
Apache Spark技术实战之8:Standalone部署模式的临时文件清理

未经本人同意严禁转载,徽沪一郎。 概要 在Standalone部署模式Spark运行过程中会创建哪些临时目录及文件,这些临时目录和文件又是在什么时候被清理,本文将就这些问题做深入细致的解答。 从资源使用的方面来看,一个进程运行期间会利用到这四个方面的资源,分别是CPU,内存,磁盘和网络 ...

Mon Mar 09 04:25:00 CST 2015 1 4099
Apache Spark源码走读之21 -- WEB UI和Metrics初始化及数据更新过程分析

欢迎转载,转载请注明出处,徽沪一郎. 概要 WEB UI和Metrics子系统为外部观察监测Spark内部运行情况提供了必要的窗口,本文将简略的过一其内部代码实现。 WEB UI 先上图感受一spark webui 假设当前已经在本机运行standalone cluster模式,输入 ...

Tue Aug 05 18:12:00 CST 2014 0 3579
 
粤ICP备18138465号  © 2018-2025 CODEPRJ.COM