惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

B
Blog RSS Feed
Martin Fowler
Martin Fowler
爱范儿
爱范儿
IT之家
IT之家
Last Week in AI
Last Week in AI
A
About on SuperTechFans
Google DeepMind News
Google DeepMind News
阮一峰的网络日志
阮一峰的网络日志
V
V2EX
aimingoo的专栏
aimingoo的专栏
G
Google Developers Blog
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
美团技术团队
The Cloudflare Blog
MyScale Blog
MyScale Blog
T
The Blog of Author Tim Ferriss
Hugging Face - Blog
Hugging Face - Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
云风的 BLOG
云风的 BLOG
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
腾讯CDC
Microsoft Security Blog
Microsoft Security Blog

博客园 - work hard work smart

Java 面试1 Java 常见面试问题 手撕java常用代码 WebStorm 创建react工程 构建企业级 Text-to-SQL Agent:基于 LangGraph 的智能数据查询系统设计 Harness 工程:驾驭 AI Agent 的工程化艺术 DeepAgents 多智能体架构实战:从设计模式到后端选型 Vue 自定义组件完全指南:从零构建待办事项应用 使用 LangChain + Hugging Face 构建文本向量化服务 SQLAlchemy 使用详解 Python 中使用 Elasticsearch 的完整指南 Qdrant 向量数据库使用指南 OpenEvals 快速入门:LLM 评估指南 DeepEval 快速入门:LLM 应用评估指南 LangSmith 批量评估完全指南 Qwen-Agent 入门指南:快速构建智能体应用 LangSmith 集成实战:从追踪到评估的完整指南 初识 go-zero:一款让你写后端更规范、更高效的 Go 微服务框架 RAG 中为什么需要 Rerank,以及如何使用 Rerank LangChain4j RAG 核心组件与组合方式 如何使用 Elasticsearch 进行全文检索和向量检索 MinerU Docker 部署指南 5 分钟上手:为 Cline 配置一个免费的 MCP 天气服务 Neo4j 图数据库安装与 Spring Boot 集成实战指南 LangFuse 实战指南:用 @observe 三行代码给 LLM 应用加上全链路追踪 Function Call 深度解析:让大模型从"嘴炮"到"实干"的技术革命 Spring AI 提示词模板实战:告别硬编码,实现提示词工程化管理 LangChain4j 实战指南:用 Java 轻松构建 AI 应用 Spring AI 对话短期记忆实战:让大模型拥有"记忆力" Spring AI 提示词工程实战:让大模型更懂你的意图
Spark 集群搭建
work hard work smart · 2026-03-13 · via 博客园 - work hard work smart

Spark 集群搭建

1、下载spark

https://archive.apache.org/dist/spark/spark-3.4.2/spark-3.4.2-bin-hadoop3.tgz

 https://mirrors.tuna.tsinghua.edu.cn/apache/spark/spark-3.4.2/spark-3.4.2-bin-hadoop3.tgz

下面这个地址会快一点

2、环境

在前面https://www.cnblogs.com/linlf03/p/18064219的基础上进行安装

安装1主2从

主 bigdata1

从 bigdata2, bigdata3

3、解压

下载后将文件拷贝到/data/software/spark-3.4.2-bin-hadoop3.tgz

cd data/software/

tar -zxvf spark-3.4.2-bin-hadoop3.tgz

4、修改配置文件 spark-env.sh

/data/software/spark-3.4.2-bin-hadoop3/conf

mv spark-env.sh.template  spark-env.sh

在末尾添加

export JAVA_HOME=/data/software/jdk1.8
export SPARK_MASTER_HOST=bigdata1

5、修改workers配置

mv workers.template  

#localhost
bigdata2
bigdata3

6、将当前bigdata1的spark文件拷贝到bigdata2和bigdata3

cd /data/software/

scp -rq spark-3.4.2-bin-hadoop3 bigdata2:/data/software/

scp -rq spark-3.4.2-bin-hadoop3 bigdata3:/data/software/

7、启动

[root@bigdata1 spark-3.4.2-bin-hadoop3]# sbin/start-all.sh
starting org.apache.spark.deploy.master.Master, logging to /data/software/spark-3.4.2-bin-hadoop3/logs/spark-root-org.apache.spark.deploy.master.Master-1-bigdata1.out
bigdata2: starting org.apache.spark.deploy.worker.Worker, logging to /data/software/spark-3.4.2-bin-hadoop3/logs/spark-root-org.apache.spark.deploy.worker.Worker-1-bigdata2.out
bigdata3: starting org.apache.spark.deploy.worker.Worker, logging to /data/software/spark-3.4.2-bin-hadoop3/logs/spark-root-org.apache.spark.deploy.worker.Worker-1-bigdata3.out

8、查看启动的进程

bigdata1 是master

[root@bigdata1 spark-3.4.2-bin-hadoop3]# jps
26187 Master

bigdata2和bigdata3

[root@bigdata2 conf]# jps
23506 Worker
23630 Jps

9、访问http://bigdata1:8080/

10、提交任务

spark-submit --class org.apache.spark.examples.SparkPi --master spark://bigdata1:7077 ../examples/jars/spark-examples_2.12-3.4.2.jar 2

查看任务,

 如上图,任务已经执行完成