4.8.4. ## 安装Spark

平台使用spark的版本为2.4.0:spark-2.4.0-bin-hadoop2.7.tgz ### 1. 将spark的安装包上传到/opt/software目录中 ### 2. 将spark安装包解压到/opt/module目录下 进入/opt/software目录下,执行 tar -zxvf spark-2.4.0-bin-hadoop2.7.tgz -C /opt/module

### 3. 将spark添加到环境变量

(1)获取spark的安装路径
(2)打开/etc/profile文件
        vim /etc/profile
        在profile文件末尾添加spark路径
#SPARK_HOME
export SPARK_HOME=/opt/module/spark-2.4.0-bin-hadoop2.7
export PATH=$PATH:$SPARK_HOME/bin
(3)保存退出
(4)让修改的配置生效
        source  /etc/profile
(5)分发配置信息
        scp -r /etc/profile root@bigdata.slave1:/etc/profile
        scp -r /etc/profile root@bigdata.slave2:/etc/profile
        进入其他机器执行 source /etc/profile

### 4. 测试是否安装成功 执行 spark-shell ### 5. 集群配置

修改spark的配置文件,配置文件路径为/opt/module/ spark-2.4.0-bin-hadoop2.7/conf
(1)配置spark-env.sh
vim spark-env.sh
在该配置文件中添加如下配置
export SCALA_HOME=/usr/local/src/scala-2.11.12
export JAVA_HOME=/opt/module/jdk1.8.0_181
export HADOOP_HOME=/opt/module/hadoop-2.8.5
export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop
export SPARK_PID_DIR=$SPARK_HOME/app/pids
SPARK_MASTER_IP=bigdata.master
SPARK_LOCAL_DIRS=/opt/module/spark-2.4.0-bin-hadoop2.7
SPARK_DRIVER_MEMORY=1G
(2)配置slaves
bigdata.slave1
bigdata.slave2

### 6. 分发配置信息到各个机器

scp -rp /opt/module/spark-2.4.0-bin-hadoop2.7 root@bigdata.slave1:/opt/module
scp -rp /opt/module/spark-2.4.0-bin-hadoop2.7 root@bigdata.slave2:/opt/module

### 7. 启动集群 (1)启动Hadoop集群 进入sbin目录:执行./start-all.sh

(2)查看集群状态 jps

(3)关闭集群 进入sbin目录:执行./stop-all.sh