您的位置：首页 > 其它

spark内核揭秘-03-spark核心组件

2015-01-18 09:46 260 查看

spark核心组件如下所示：

在SparkContext初始化的时候，会初始化一系列内容：

查看内存使用情况：

创建和启动scheduler：

集群核心组件中的Block tracker是用于block和partition对应关系的管理。

集群核心组件中的shuffle tracker是用于记录shuffle操作的过程细节。

从集群中也可以看出，Executor在执行任务的时候是采用多线程的方式执行的并能够在HDFS或者HBase等系统上读取数据。

而在实际的Driver Program运行的时候每个partition都会由一个task负责运行的

也就是说有多partition就会有多少task在运行，而这些task都是并发的运行在Executor中的。

内容来自用户分享和网络整理，不保证内容的准确性，如有侵权内容，可联系管理员处理

标签：

相关文章推荐

spark内核揭秘-03-spark核心组件
spark内核揭秘-05-SparkContext核心源码解析初体验
spark内核揭秘-05-SparkContext核心源码解析初体验
spark内核揭秘-01-spark内核核心术语解析
spark内核揭秘-01-spark内核核心术语解析
spark内核揭秘-04-spark任务调度系统个人理解
spark内核揭秘-13-Worker中Executor启动过程源码分析
spark学习-核心组件
spark内核揭秘-13-Worker中Executor启动过程源码分析
spark内核揭秘-10-RDD源码分析
spark内核揭秘-10-RDD源码分析
spark内核揭秘-09-RDD的count操作触发Job全生命周期-02
spark内核揭秘-14-Spark性能优化的10大问题及其解决方案
Hadoop与Spark的核心组件对比
spark内核揭秘-09-RDD的count操作触发Job全生命周期-01
spark内核揭秘-09-RDD的count操作触发Job全生命周期-02
Vert.x 核心模块内核组件Verticle（二）
spark内核揭秘-09-RDD的count操作触发Job全生命周期-01
spark内核揭秘-11-Driver中AppClient源码分析
spark内核揭秘-14-Spark性能优化的10大问题及其解决方案

新的分享

一次教科书级别的Redis高可用架构设计实践 - Redis
曾光：北京这次的毒株不像国内流行类型
从PRD文档到产品上线，有哪些问题需要解决？
vue3自定义指令的使用
Oracle SQL性能优化最常用的40条建议 - ORACLE
程序员翻车常见反应，你中枪了吗？ - 职场生涯
新鲜开源：基于Prometheus的企业监控平台设计与实现 - 运维
嵌入式软件开发之程序架构设计-任务调度
【Java面试】请简单说一下你对受检异常和非受检异常的理解
奇安信更新招股书：第一季亏损过5亿，齐向东持股38%
艾瑞咨询：2020年中国后智能厨房案例研究报告
艾瑞咨询：2020年中国人工智能+物流发展研究报告

章节导航