spark集群部署(第三弹)
修改spark-env.sh配置文件
$ssh master
$cd opt/module/spark/conf
$vi spark-env.sh
export JAVA_HOME=/opt/module/jdk1.8.0_144
#export SPARK_MASTER_HOST=master
export SPARK_MASTER_PORT=7077
export SPARK_DAEMON_JAVA_OPTS="-Dspark.deploy.recoveryMode=ZOOKEEPER
-Dspark.deploy.zookeeper.url=master:2181,slave1:2181,slave2:2181
-Dspark.deploy.zookeeper.dir=/spark"
(1)spark.deploy.recoveryMode=ZOOKEEPER:设置zookeeper去启用备用master模式
(2)spark.deploy.zookeeper.url=master:指定zookeeper的server地址
(3)spark.deploy.zookeeper.dir:保存集群元数据信息的文件和目录
将spark-env.sh分发至slave1和slave2节点上,保证配置文件统一
scp spark-env.sh slave1:/opt/module/spark/conf/
scp spark-env.sh slave2:/opt/module/spark/conf/
启动spark HA集群
$cd /opt/module/zookeeper/bin
$ zkServer.sh start
$cd opt/software/spark
$sbin/stop-all.sh
在master节点上单独启动spark服务
$/opt/module/spark/sbin/start-all.sh
在slave1节点上单独启动Master服务
$/opt/module/spark/sbin/start-master.sh
Status:STANDBY # 说明spark HA配置完成
测试spark HA集群,为演示是否解决单点故障问题,关闭master节点的master进程
$ /opt/module/spark/sbin/stop-master.sh
