spark内核揭秘-05-SparkContext核心源码解析初体验 - stark_summer - ITeye博客

`

Stark_Summer

浏览: 709374 次
性别:
来自: 大连

最近访客更多访客>>

loginboot

街头诗人

ahww520

sz_jack

博主相关

博客

微博

相册

收藏

留言

关于我

文章分类

社区版块

存档分类

最新评论

lixuanbin： iteye已经快要tj了吧。。
iteye为什么不支持markdown?
haorengoodman： Tachyon 能在做数据分类吗？例如我有一坨hdfs文件，将 ...
tachyon与hdfs,以及spark整合
lee3836：求源码，大牛
clover分布式任务调度系统
cfan37： ...
sparksql与hive整合
greemranqq： 9.9 送上，希望博客长久~。~
【【【【【#####>>>>>【关于我】【您·的·支·持·是·我·最·大·的·动·力】<<<<<#####】】】】】

spark内核揭秘-05-SparkContext核心源码解析初体验

博客分类：

spark

akka TaskScheduler SparkDeployScheduler CoarseGrainedExecutor Executor

阅读更多

SparkContext在获得了一系列的初始化信息后开始创建并启动TaskScheduler实例：

进入createTaskScheduler方法：

我们看一下其Standalone的方式：

在上述代码中首先实例化一个TaskSchedulerImpl：

然后构建出了masterUrls：

接着创建出关键的backend：

进入SparkDeploySchedulerBackend实现：

从以上截图可以看出来，SparkDeploySchedulerBackend核心是为了启动CoarseGrainedExecutorBackend

此处使用了Akka技术进行不同机器之间的通信，CoarseGrainedExecutorBackend是具体在Worker上执行具体的任务的进程的代表，所以我们的backend实例就是用来提交任务给Executor的：

其实CoarseGrainedExecutorBackend是Executor的代理人，能够完成很多任务，例如启动一个任务：LaunchTask

回到SparkContext的Standalone的方式的代码处：

接着代码是把backend传给了TaskSchedulerImpl的initialize方法中：

在上述代码中显示处理调度模式例如FIFO和Fair的模式。

在代码块的最后返回实例化后的backend, scheduler：

PS:妈蛋的公司破网，spark源码没下载成功，只能在github上面看了，蛋疼

0
顶

4
踩

分享到：

spark内核揭秘-06-TaskSceduler启动源码解 ... | spark内核揭秘-04-spark任务调度系统个人 ...

2015-01-19 15:09
浏览 2522
评论(0)
分类:编程语言
查看更多

评论

发表评论

您还没有登录,请您登录后再发表评论

相关推荐

spark-3.1.3-bin-without-hadoop.tgz: Spark安装包：spark-3.1.3-bin-without-hadoop.tgz

spark-3.1.3-bin-hadoop3.2.tgz: Apache Spark版本3.1.3。Linux安装包。spark-3.1.3-bin-hadoop3.2.tgz

spark-2.0.0-bin-hadoop2.6.tgz: 本资源是spark-2.0.0-bin-hadoop2.6.tgz百度网盘资源下载,本资源是spark-2.0.0-bin-hadoop2.6.tgz百度网盘资源下载

apache-doris-spark-connector-2.3_2.11-1.0.1: Spark Doris Connector（apache-doris-spark-connector-2.3_2.11-1.0.1-incubating-src.tar.gz） Spark Doris Connector Version：1.0.1 Spark Version：2.x Scala Version：2.11 Apache Doris是一个现代MPP分析...

spark-3.2.0-bin-hadoop3.2.tgz: spark-3.2.0-bin-hadoop3.2.tgz

spark-3.0.0-bin-hadoop3.2: spark-3.0.0-bin-hadoop3.2下载安装包

spark-2.3.4-bin-hadoop2.7.tgz: pyspark本地的环境配置包，spark-2.3.4-bin-hadoop2.7.tgz：spark-2.3.4-bin-hadoop2.7.tgz

spark-3.2.4-bin-hadoop3.2-scala2.13 安装包: spark-3.2.4-bin-hadoop3.2-scala2.13 安装包

编译的spark-hive_2.11-2.3.0和 spark-hive-thriftserver_2.11-2.3.0.jar: spark-hive_2.11-2.3.0 spark-hive-thriftserver_2.11-2.3.0.jar log4j-2.15.0.jar slf4j-api-1.7.7.jar slf4j-log4j12-1.7.25.jar curator-client-2.4.0.jar curator-framework-2.4.0.jar curator-recipes-2.4.0....

spark-assembly-1.5.2-hadoop2.6.0.jar: spark-assembly-1.5.2-hadoop2.6.0 在spark编程中使用的一个jar

spark-streaming-kafka-0-8_2.11-2.4.0.jar: spark-streaming-kafka-0-8_2.11-2.4.0.jar

spark-3.2.1-bin-hadoop2.7.tgz: linux的spark新版本，匹配hadoop2.7版本，spark-3.2.1-bin-hadoop2.7.tgz

spark-hive-thriftserver_2.11-2.1.3-SNAPSHOT-123456.jar: spark-hive-thriftserver_2.11-2.1.spark-hive-thrift

spark-2.4.8-bin-hadoop2.7.tgz: spark-2.4.8-bin-hadoop2.7.tgz

spark-streaming-flume_2.11-2.1.0.jar: spark-streaming-flume_2.11-2.1.0.jar

spark-2.4.0-bin-hadoop2.7.tgz: spark-2.4.0-bin-hadoop2.7

spark-3.0.0-bin-hadoop2.7.tgz: spark-3.0.0-bin-hadoop2.7.tgz 官网下载不了的，需要资源的，可以到这里下载哦

spark-1.6.3-bin-hadoop2.6.tgz: spark-1.6.3-bin-hadoop2.6.tgz

spark-2.2.0-yarn-shuffle.jar: spark-2.2.0-yarn-shuffle.jar

spark-2.3.1-bin-hadoop2.7.zip: spark-2.3.1-bin-hadoop2.7.zip

Global site tag (gtag.js) - Google Analytics