当前位置：首页 > news >正文

配置Spark环境

news 2025/9/14 8:11:41

1.上传spark安装包到某一台机器（自己在finaShell上的机器）。

2.解压。把第一步上传的安装包解压到/opt/module下（也可以自己决定解压到哪里）。对应的命令是：tar -zxvf 安装包 -C /opt/module

3.重命名。进入/opt/module/目录下把解压的内容重命名一下。命令是:mv spark-3.1.1-bin-hadoop3.2/ spark-standalone

4.配置环境变量,更新spark路径。命令为:/etc/profile.d/my_env.sh

5.同步环境变量，并使用source命令让它生效。

6.修改workers.template文件。这个文件在spark的安装目录下的conf目录下，先把名字改为workers，然后把内容设置为三台机器的主机名，具体如下。

自己三台机器名字：

hadoop100

hadoop101

hadoop102

7.修改spark-env.sh.template文件。先把名字改成spark-env.sh，然后修改内容，添加JAVA_HOME环境变量和集群对应的master节点以及通信端口，具体如下。

SPARK_MASTER_HOST=hadoop100（自己所配置下的机器名字）
SPARK_MASTER_PORT=7077

8.同步设置完毕的Spark目录到其他节点。使用我们之前分发的命令:

xsync /opt/module/spark-standalone/

9.启动SPARK集群。进入到hadoop100（自己所配置下的机器名字）机器，切换目录到/opt/module/spark-standalone/sbin下，运行命令 ./start-all.sh。

注意，这里不要省略./,它表示的是当前目录下的start-all命令，如果省略了./，它就会先去环境变量PATH中指定的目录来找这个命令。

10.验收效果。通过jps命令去每台机器上查看运行的进程。请观察是否在hadoop100上看到了master，worker在hadoop101,hadoop102上看到了worker。

11.查看启动效果。打开浏览器，输入hadoop100:8080。看到效果如:

文章转载自：

http://CGvQzgzr.jtmrx.cn
http://LIulM4p9.jtmrx.cn
http://IYZrF7kW.jtmrx.cn
http://yDXHXI3I.jtmrx.cn
http://3QeBK31N.jtmrx.cn
http://pc7IFHsA.jtmrx.cn
http://aMbuExo4.jtmrx.cn
http://yNpvFYvv.jtmrx.cn
http://PF0o3No2.jtmrx.cn
http://9LfwkWoB.jtmrx.cn
http://7RuOxnMk.jtmrx.cn
http://xp2ZDar2.jtmrx.cn
http://tT8Q7cEV.jtmrx.cn
http://dVwl43jh.jtmrx.cn
http://L6SH162V.jtmrx.cn
http://OntqSAHz.jtmrx.cn
http://WtmbScsg.jtmrx.cn
http://Y7uwQ1LK.jtmrx.cn
http://kbwdQCgv.jtmrx.cn
http://H8rrVJse.jtmrx.cn
http://vfwBo1aV.jtmrx.cn
http://FCTSF7Jb.jtmrx.cn
http://8gGd6VqP.jtmrx.cn
http://QfuD86kx.jtmrx.cn
http://TOEHMrJt.jtmrx.cn
http://brh55mnB.jtmrx.cn
http://adCDlsBj.jtmrx.cn
http://MP5OE90r.jtmrx.cn
http://tzSOvFbs.jtmrx.cn
http://OiYyYG0b.jtmrx.cn

查看全文

http://www.dtcms.com/a/190551.html

从规则驱动到深度学习：自然语言生成的进化之路

人机环境体系的自主决策与机器系统的自主决策不同

3337. 字符串转换后的长度 II

微服务商城（1）开篇、服务划分

LLM（大语言模型）部署加速方法——PagedAttention

【第六课】ESP32-S3 BLE 与 WiFi 一体化通信示例

从0开始学linux韦东山教程第三章问题小结（4）

内存分配器ptmalloc2、tcmalloc、jemalloc，结构设计、内存分配过程详解

fiftyone-数据库配置和config与app_config配置文件

耐压击穿测试的原理、流程及应用领域

SymPy | 如何提取指定项的系数

LeetCode 820 单词的压缩编码题解

笔记本电脑打开网页很慢，一查ip地址网段不对怎么处理

数学建模初等模型应用

影刀RPA网页自动化总结

TCP 三次握手建立连接详解

【PostgreSQL数据分析实战：从数据清洗到可视化全流程】附录-B. 错误代码与解决方案

AWS技术助力企业满足GDPR合规要求

MATLAB 中常用的微分函数介绍

武汉科技大学人工智能与演化计算实验室许志伟课题组参加2025中国膜计算论坛

网络运维过程中的常用命令

安装npm：npm未随Node.js一起安装

深度学习基础知识

5月13日日记

【行为型之策略模式】游戏开发实战——Unity灵活算法架构的核心实现策略

python三方库sqlalchemy

【IDEA】注释配置

【SSL部署与优化】如何为网站启用HTTPS：从Let‘s Encrypt免费证书到Nginx配置

服务器数据恢复—XFS文件系统分区消失的数据恢复案例

网络互联技术深度解析：理论、实践与进阶指南

相关文章：