m635674608

浏览: 5028636 次
性别:
来自: 南京

最近访客更多访客>>

wusuosuo

yijiaomuqing

millerchu

xdung

博主相关

博客

微博

相册

留言

关于我

文章分类

社区版块

存档分类

spark-submit工具参数说明

博客分类：

spark

http://blog.csdn.net/sa14023053/article/details/51986549

https://my.oschina.net/u/140462/blog/519409

–master 指定spark运行模式

参数模式

Local[N]	本地模式。使用N个线程
Local cluster[worker,core,Memory]	伪分布式模式，可以配置所需要启动的虚拟工作节点数量，以及每个工作节点所管理的CPU的数量和内存大小
Spark://hostname:port	Standalone 模式、需要部署Spark到相关节点，URL 为Spark Master 主机地址和端口（Spark://master:7077）
Mesos://hostname:port	Mesos 模式，需要部署Spark 和Mesos到相关节点，URL为Mesos主机地址和端口
YARN standalone/YARN cluster	YARN 模式一，主程序逻辑和任务都运行在YARN集群中
YARN client	YARN 模式二，主程序逻辑运行在本地，具体任务运行在YARN集群

执行时需要传入的参数说明

Usage: spark-submit [options] <app jar | python file> [app options]

参数名称	含义
--master MASTER_URL	可以是spark://host:port, mesos://host:port, yarn, yarn-cluster,yarn-client, local
--deploy-mode DEPLOY_MODE	Driver程序运行的地方，client或者cluster
--class CLASS_NAME	主类名称，含包名
--name NAME	Application名称
--jars JARS	Driver依赖的第三方jar包
--py-files PY_FILES	用逗号隔开的放置在Python应用程序PYTHONPATH上的.zip, .egg, .py文件列表
--files FILES	用逗号隔开的要放置在每个executor工作目录的文件列表
--properties-file FILE	设置应用程序属性的文件路径，默认是conf/spark-defaults.conf
--driver-memory MEM	Driver程序使用内存大小
--driver-java-options
--driver-library-path	Driver程序的库路径
--driver-class-path	Driver程序的类路径
--executor-memory MEM	executor内存大小，默认1G
--driver-cores NUM	Driver程序的使用CPU个数，仅限于Spark Alone模式
--supervise	失败后是否重启Driver，仅限于Spark Alone模式
--total-executor-cores NUM	executor使用的总核数，仅限于Spark Alone、Spark on Mesos模式
--executor-cores NUM	每个executor使用的内核数，默认为1，仅限于Spark on Yarn模式
--queue QUEUE_NAME	提交应用程序给哪个YARN的队列，默认是default队列，仅限于Spark on Yarn模式
--num-executors NUM	启动的executor数量，默认是2个，仅限于Spark on Yarn模式
--archives ARCHIVES	仅限于Spark on Yarn模式

分享到：

sparksql与hive整合 | Spark Streaming实践和优化

2017-05-22 15:05
浏览 1140
评论(0)
分类:编程语言
查看更多

发表评论

您还没有登录,请您登录后再发表评论

最近访客更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论

spark-submit工具参数说明

http://blog.csdn.net/sa14023053/article/details/51986549

评论

发表评论

相关推荐

最近访客 更多访客>>

博主相关

文章分类

社区版块

存档分类

最新评论

spark-submit工具参数说明

http://blog.csdn.net/sa14023053/article/details/51986549

评论

发表评论

相关推荐

Spark_总结五

Spark Streaming 结合 Kafka 两种不同的数据接收方式比较

Spark-Streaming获取kafka数据的两种方式-Receiver与Direct的方式

Spark Streaming中KafkaReceiver内幕实现彻底解密

Spark2.1.0文档：Spark Streaming 编程指南（上）

Spark MLlib之协同过滤

spark-streaming-kafka包源码分析

Spark Streaming：性能调优

Apache Spark探秘：Spark Shuffle实现

Spark2.1.0入门：DStream转换操作

No output streams registered, so nothing to execute

了解SparkSQL运行计划及调优

sparksql性能调优

Spark性能优化：开发调优篇

Spark性能优化：数据倾斜调优

Spark性能优化：资源调优篇

Spark性能优化：shuffle调优

Spark java.lang.outofmemoryerror gc overhead limit exceeded 与 spark OOM:java hea

Spark 内存分配

基于Spark UI性能优化与调试——初级篇

最近访客更多访客>>