spark-submit工具参数说明
2016-01-05 23:43
423 查看
参数名称 | 含义 |
--master MASTER_URL | 可以是spark://host:port, mesos://host:port, yarn, yarn-cluster,yarn-client, local |
--deploy-mode DEPLOY_MODE | Driver程序运行的地方,client或者cluster |
--class CLASS_NAME | 主类名称,含包名 |
--name NAME | Application名称 |
--jars JARS | Driver依赖的第三方jar包 |
--py-files PY_FILES | 用逗号隔开的放置在Python应用程序PYTHONPATH上的.zip, .egg, .py文件列表 |
--files FILES | 用逗号隔开的要放置在每个executor工作目录的文件列表 |
--properties-file FILE | 设置应用程序属性的文件路径,默认是conf/spark-defaults.conf |
--driver-memory MEM | Driver程序使用内存大小 |
--driver-java-options | |
--driver-library-path | Driver程序的库路径 |
--driver-class-path | Driver程序的类路径 |
--executor-memory MEM | executor内存大小,默认1G |
--driver-cores NUM | Driver程序的使用CPU个数,仅限于Spark Alone模式 |
--supervise | 失败后是否重启Driver,仅限于Spark Alone模式 |
--total-executor-cores NUM | executor使用的总核数,仅限于Spark Alone、Spark on Mesos模式 |
--executor-cores NUM | 每个executor使用的内核数,默认为1,仅限于Spark on Yarn模式 |
--queue QUEUE_NAME | 提交应用程序给哪个YARN的队列,默认是default队列,仅限于Spark on Yarn模式 |
--num-executors NUM | 启动的executor数量,默认是2个,仅限于Spark on Yarn模式 |
--archives ARCHIVES | 仅限于Spark on Yarn模式 |
相关文章推荐
- [转] GitHub上README.md教程
- 问题记录
- Linux学习笔记4-三种不同类型的软件的安装(绿色软件、rpm软件、源代码软件)
- Spark-Sql
- Java泛型初探
- Linux学习笔记4-三种不同类型的软件的安装(绿色软件、rpm软件、源代码软件)
- saltstack安装指导(一)
- 管理数据库和表
- leetcode 66: Plus One
- bzoj3172【TJOI2013】单词
- xsl与xml转换示例
- Meteor:关闭所有tab时退出登录
- lesson1:Python 判断表达式应用
- maven是什么?(转自oracle官网)
- Java延迟初始化的2种经典模式
- Spark MLlib 包
- mysql 5.7 忘记密码,及修改密码问题,密码列不再是Password ,而是authentication_string
- UITableView的简单使用
- 单个电脑上进行多ssh-key配置
- RDD容错