spark-submit 常用方式

1 、local 模式提交

在本地机器上使用2个CPU核心,以并行方式运行名为 spark-python.py 的 PySpark 应用程序

复制代码
spark-submit --master local[2] spark-python.py

更完整的提交命令示例

复制代码
spark-submit \
  --master local[2] \
  --name "MySparkApp" \
  --executor-memory 2g \
  --driver-memory 1g \
  spark-python.py
2、集群模式提交

spark-python.py 这个 PySpark 应用程序提交到位于 node03:7077 的 Spark 集群上,在多个工作节点上分布式并行执行"

复制代码
spark-submit --master spark://node03:7077 spark-python.py

带更多配置的集群提交

复制代码
spark-submit \
  --master spark://node03:7077 \
  --executor-memory 2g \
  --total-executor-cores 4 \
  --name "ProductionJob" \
  spark-python.py
相关推荐
whuang09433 分钟前
腾讯云 emr 无法以cosn 写入云存储
spark
weixin_3709763543 分钟前
AI的终极赛跑:进入AGI,还是泡沫破灭?
大数据·人工智能·agi
一切皆是因缘际会3 小时前
AI数字分身的底层原理:破解意识、自我与人格复刻的核心难题
大数据·人工智能·ai·架构
上海光华专利事务所3 小时前
跨境电商商标专利管理平台
大数据·产品运营
Elastic 中国社区官方博客4 小时前
ES|QL METRICS_INFO 和 TS_INFO:为你的时间序列数据建立目录
大数据·数据库·elasticsearch·搜索引擎·信息可视化·全文检索
jinanwuhuaguo5 小时前
(第二十七篇)OpenClaw四月的演化风暴:OpenClaw 2026年4月全版本更新的文明级解读
大数据·人工智能·架构·kotlin·openclaw
清晨0016 小时前
工业生产实时数据获取方案-TDengine
大数据·时序数据库·tdengine
极创信息6 小时前
信创产品认证怎么做?信创产品测试认证的主要流程
java·大数据·数据库·金融·软件工程
Elastic 中国社区官方博客6 小时前
Elastic 和 Cursor 合作 加速 上下文工程 与 coding agents
大数据·人工智能·elasticsearch·搜索引擎·全文检索
lzhdim7 小时前
SQL 入门 12:SQL 视图:创建、修改与可更新视图
java·大数据·服务器·数据库·sql