centOS7下Spark安裝配置教程詳解
環(huán)境說明:
操作系統(tǒng): centos7 64位 3臺(tái)
centos7-1 192.168.190.130 master
centos7-2 192.168.190.129 slave1
centos7-3 192.168.190.131 slave2
安裝spark需要同時(shí)安裝如下內(nèi)容:
jdk scale
1.安裝jdk,配置jdk環(huán)境變量
這里不講如何安裝配置jdk,自行百度。
2.安裝scala
下載scala安裝包,https://www.scala-lang.org/download/選擇符合要求的版本進(jìn)行下載,使用客戶端工具上傳到服務(wù)器上。解壓:
#tar -zxvf scala-2.13.0-M4.tgz 再次修改/etc/profile文件,添加如下內(nèi)容: export SCALA_HOME=$WORK_SPACE/scala-2.13.0-M4 export PATH=$PATH:$SCALA_HOME/bin #source /etc/profile // 讓其立即生效 #scala -version //查看scala是否安裝完成
3.安裝spark
spark下載地址:http://spark.apache.org/downloads.html
說明:有不同的版本包下載,選則你需要的下載安裝即可
Source code: Spark 源碼,需要編譯才能使用,另外 Scala 2.11 需要使用源碼編譯才可使用
Pre-build with user-provided Hadoop: “Hadoop free” 版,可應(yīng)用到任意 Hadoop 版本
Pre-build for Hadoop 2.7 and later: 基于 Hadoop 2.7 的預(yù)先編譯版,需要與本機(jī)安裝的 Hadoop 版本對(duì)應(yīng)??蛇x的還有 Hadoop 2.6。我這里因?yàn)檠b的hadoop是3.1.0,所以直接安裝for hadoop 2.7 and later的版本。
注:hadoop的安裝請(qǐng)查看我的上一篇博客,不在重復(fù)描述。

centOS7下Spark安裝配置 #mkdir spark #cd /usr/spark #tar -zxvf spark-2.3.1-bin-hadoop2.7.tgz #vim /etc/profile #添加spark的環(huán)境變量,加如PATH下、export出來 #source /etc/profile #進(jìn)入conf目錄下,把spark-env.sh.template拷貝一份改名spark-env.sh #cd /usr/spark/spark-2.3.1-bin-hadoop2.7/conf #cp spark-env.sh.template spark-env.sh #vim spark-env.sh export SCALA_HOME=/usr/scala/scala-2.13.0-M4 export JAVA_HOME=/usr/lib/jvm/jre-1.8.0-openjdk-1.8.0.171-8.b10.el7_5.x86_64 export HADOOP_HOME=/usr/hadoop/hadoop-3.1.0 export HADOOP_CONF_DIR=$HADOOP_HOME/etc/hadoop export SPARK_HOME=/usr/spark/spark-2.3.1-bin-hadoop2.7 export SPARK_MASTER_IP=master export SPARK_EXECUTOR_MEMORY=1G #進(jìn)入conf目錄下,把slaves.template拷貝一份改名為slaves #cd /usr/spark/spark-2.3.1-bin-hadoop2.7/conf #cp slaves.template slaves #vim slaves #添加節(jié)點(diǎn)域名到slaves文件中 #master //該域名為centos7-1的域名 #slave1 //該域名為centos7-2的域名 #slave2 //該域名為centos7-3的域名
啟動(dòng)spark
#啟動(dòng)spark之前先要把hadoop節(jié)點(diǎn)啟動(dòng)起來 #cd /usr/hadoop/hadoop-3.1.0/ #sbin/start-all.sh #jps //檢查啟動(dòng)的線程是否已經(jīng)把hadoop啟動(dòng)起來了 #cd /usr/spark/spark-2.3.1-bin-hadoop2.7 #sbin/start-all.sh 備注:在slave1\slave2節(jié)點(diǎn)上也必須按照上面的方式安裝spark,或者直接拷貝一份到slave1,slave2節(jié)點(diǎn)上 #scp -r /usr/spark root@slave1ip:/usr/spark
啟動(dòng)信息如下:
starting org.apache.spark.deploy.master.Master, logging to /usr/spark/logs/spark-root-org.apache.spark.deploy.master.Master-1-master.out
slave2: starting org.apache.spark.deploy.worker.Worker, logging to /usr/spark/logs/spark-root-org.apache.spark.deploy.worker.Worker-1-slave2.com.cn.out
slave1: starting org.apache.spark.deploy.worker.Worker, logging to /usr/spark/logs/spark-root-org.apache.spark.deploy.worker.Worker-1-slave1.com.cn.out
master: starting org.apache.spark.deploy.worker.Worker, logging to /usr/spark/logs/spark-root-org.apache.spark.deploy.worker.Worker-1-master.out
測(cè)試Spark集群:
用瀏覽器打開master節(jié)點(diǎn)上的spark集群url:http://192.168.190.130:8080/

總結(jié)
以上所述是小編給大家介紹的centOS7下Spark安裝配置教程詳解,希望對(duì)大家有所幫助,如果大家有任何疑問歡迎給我留言,小編會(huì)及時(shí)回復(fù)大家的!
- linux環(huán)境不使用hadoop安裝單機(jī)版spark的方法
- 淺談七種常見的Hadoop和Spark項(xiàng)目案例
- Python搭建Spark分布式集群環(huán)境
- 使用docker快速搭建Spark集群的方法教程
- Spark學(xué)習(xí)筆記(一)Spark初識(shí)【特性、組成、應(yīng)用】
- 初識(shí)Spark入門
- 詳解Java編寫并運(yùn)行spark應(yīng)用程序的方法
- Spark整合Mongodb的方法
- java 中Spark中將對(duì)象序列化存儲(chǔ)到hdfs
- Spark學(xué)習(xí)筆記 (二)Spark2.3 HA集群的分布式安裝圖文詳解
相關(guān)文章
Linux下查看CPU型號(hào),內(nèi)存大小,硬盤空間的命令(詳解)
下面小編就為大家?guī)硪黄狶inux下查看CPU型號(hào),內(nèi)存大小,硬盤空間的命令(詳解)。小編覺得挺不錯(cuò)的,現(xiàn)在就分享給大家,也給大家做個(gè)參考。一起跟隨小編過來看看吧2016-11-11
Linux內(nèi)核宏Container_Of的詳細(xì)解釋
我們?cè)诜治鯨inux內(nèi)核鏈表的時(shí)候注意到內(nèi)核在求解結(jié)構(gòu)體偏移的時(shí)候巧妙的使用了container_of宏定義,本文我們就來詳細(xì)剖析下內(nèi)核到底是如何求解結(jié)構(gòu)體成員變量的地址的2021-09-09
apache中通過mod_rewrite實(shí)現(xiàn)偽靜態(tài)頁面的方法
mod_rewrite是Apache的一個(gè)非常強(qiáng)大的功能,它可以實(shí)現(xiàn)偽靜態(tài)頁面。下面我詳細(xì)說說它的使用方法!對(duì)初學(xué)者很有用的哦!2011-08-08
Linux中特殊權(quán)限SUID、SGID與SBIT的深入講解
linux對(duì)文件的權(quán)限管理簡(jiǎn)直是讓人嘆為觀止,所以這篇文章主要給大家介紹了關(guān)于Linux中特殊權(quán)限SUID、SGID與SBIT的相關(guān)資料,文中通過示例代碼介紹的非常詳細(xì),需要的朋友可以參考借鑒,下面隨著小編來一起學(xué)習(xí)學(xué)習(xí)吧2018-09-09

