惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
S
Schneier on Security
C
Cyber Attacks, Cyber Crime and Cyber Security
N
News and Events Feed by Topic
TaoSecurity Blog
TaoSecurity Blog
T
Threat Research - Cisco Blogs
博客园 - 三生石上(FineUI控件)
大猫的无限游戏
大猫的无限游戏
The Last Watchdog
The Last Watchdog
Latest news
Latest news
AI
AI
Webroot Blog
Webroot Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
The Hacker News
The Hacker News
Google DeepMind News
Google DeepMind News
S
Securelist
IT之家
IT之家
雷峰网
雷峰网
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
P
Proofpoint News Feed
Last Week in AI
Last Week in AI
博客园 - Franky
美团技术团队
Cyberwarzone
Cyberwarzone
C
CERT Recently Published Vulnerability Notes
Security Archives - TechRepublic
Security Archives - TechRepublic
Security Latest
Security Latest
T
Tailwind CSS Blog
S
Security Affairs
S
Security @ Cisco Blogs
H
Heimdal Security Blog
腾讯CDC
N
News | PayPal Newsroom
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
博客园 - 司徒正美
博客园_首页
Jina AI
Jina AI
M
MIT News - Artificial intelligence
Hacker News - Newest:
Hacker News - Newest: "LLM"
B
Blog
F
Full Disclosure
www.infosecurity-magazine.com
www.infosecurity-magazine.com
T
The Blog of Author Tim Ferriss
Schneier on Security
Schneier on Security
N
News and Events Feed by Topic
NISL@THU
NISL@THU
C
Cisco Blogs
T
Troy Hunt's Blog
O
OpenAI News
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More

博客园 - work hard work smart

使用 LangChain + Hugging Face 构建文本向量化服务 SQLAlchemy 使用详解 Python 中使用 Elasticsearch 的完整指南 Qdrant 向量数据库使用指南 OpenEvals 快速入门:LLM 评估指南 DeepEval 快速入门:LLM 应用评估指南 LangSmith 批量评估完全指南 Qwen-Agent 入门指南:快速构建智能体应用 LangSmith 集成实战:从追踪到评估的完整指南 初识 go-zero:一款让你写后端更规范、更高效的 Go 微服务框架 RAG 中为什么需要 Rerank,以及如何使用 Rerank LangChain4j RAG 核心组件与组合方式 如何使用 Elasticsearch 进行全文检索和向量检索 MinerU Docker 部署指南 5 分钟上手:为 Cline 配置一个免费的 MCP 天气服务 Neo4j 图数据库安装与 Spring Boot 集成实战指南 LangFuse 实战指南:用 @observe 三行代码给 LLM 应用加上全链路追踪 Function Call 深度解析:让大模型从"嘴炮"到"实干"的技术革命 Spring AI 提示词模板实战:告别硬编码,实现提示词工程化管理 LangChain4j 实战指南:用 Java 轻松构建 AI 应用 Spring AI 对话短期记忆实战:让大模型拥有"记忆力" Spring AI 提示词工程实战:让大模型更懂你的意图 Spring AI ChatClient 深度解析:优雅构建大模型应用的利器 Spring AI Alibaba DashScopeChatModel 实战 Spring 中 SSE 流式输出的多种实现方式详解 OpenSandbox 实战指南:为 AI Agent 构建安全的代码执行沙箱 在本机启动 LangGraph 开发服务器:完整指南 DeepAgents中Backend的奥秘:让AI Agent拥有文件操作能力 为什么选择 Go 开发 Web 接口?从入门到实践 智能搜索DeepAgent笔记 RAG学习笔记2--系统查询流程 RAG学习笔记1--系统文件导入流程 百炼 WebSearch 快速入门指南 Python 连接 MongoDB 完整指南:从连接配置到增删改查实战 一行命令搞定 MongoDB 开发环境:Docker Compose 部署 + 可视化管理 使用 Attu 可视化管理 Milvus 向量数据库 在 Windows Docker 中快速安装 Milvus 2.5.6 minio使用 Spark 集群搭建 Spring AI Alibaba 入门实战 Windows 安装 OpenClaw 实战指南 MyBatis 核心流程和原理 Idea中安装Claude code插件 Spark 编程 使用Matplotlib 绘制直方图 Flink安装部署 Flume安装 查找导致cpu过高的代码方法 JVisualVM监控远程Java进程 jmap jacoco多模块生成java单元测试报告实践 arthas 使用demo LockSupport Exchanger CyclicBarrier CountDownLatch 手把手教你用python开始第一个机器学习项目
hadoop集群安装
work hard work smart · 2026-03-13 · via 博客园 - work hard work smart

hadoop集群安装

官网下载地址:https://archive.apache.org/dist/hadoop/common/hadoop-3.2.0/hadoop-3.2.0.tar.gz

因为下载的速度比较慢,可以从https://mirrors.tuna.tsinghua.edu.cn/apache/hadoop/common/下载对应的版本,如果没有版本,建议还是从官网下载

一、服务器规划

准备三台linux服务器,centos 7, 安装1主2从

  IP地址 安装 hostname
服务器1 192.168.127.163 DameNode,Secondary namenode, Recource Manager bigdata1
服务器2 192.168.127.164 DataNode,  Node Manager bigdata2
服务器3 192.168.127.165 DataNode,  Node Manager bigdata3

二、环境准备

分別修改每台服务器的配置

2.1 配置hostname

hostname bigdata1

vi /etc/hostname

 2.2 关闭防火墙

service iptables stop

systemctl disable iptables

2.3 免密登录

在bigdata1上生成公钥和私钥

ssh-keygen -t rsa

一路回车

cat ~/.ssh/id_rsa.pub   >> ~/.ssh/authorized_keys

然后将公钥拷贝到bigdata2和bigdata3

scp ~/.ssh/authorized_keys  bigdata2:~/.ssh/

scp ~/.ssh/authorized_keys  bigdata3:~/.ssh/

2.4 jdk安装

jdk版本: jdk-8u211-linux-x64.tar.gz

解压到 /data/software/jdk1.8

配置环境变量

vi /etc/profile 末尾增加如下配置

export JAVA_HOME=/data/software/jdk1.8
export PATH=.:$JAVA_HOME/bin:$PATH

使配置生效

source /etc/profile

确认java版本  java -version

2.5 host配置

vi /etc/hosts

192.168.127.163 bigdata1
192.168.127.164 bigdata2
192.168.127.165 bigdata3

2.6 同步时间

yum install -y ntpdate

[root@bigdata1 network-scripts]# ntpdate
13 Mar 21:13:58 ntpdate[12255]: no servers can be used, exiting

同步时间的指令

ntpdate -u ntp.sjtu.edu.cn

定时任务 每分钟执行1次

vi /etc/crontab 

* * * * * root   /sbin/ntpdate -u ntpdate -u ntp.sjtu.edu.cn

三、hadoop安装

1、解压安装包

将hadoop安装包解压到/data/software路径下

2、修改hadoop-env.sh配置

/data/software/hadoop-3.2.0/etc/hadoop/hadoop-env.sh

增加配置

export JAVA_HOME=/data/software/jdk1.8

export HADOOP_LOG_DIR=/data/hadoop_repo/logs/hadoop

HADOOP_LOG_DIR日志文件路径

3、修改core-site配置

 vi /data/software/hadoop-3.2.0/etc/hadoop/core-site.xml

<configuration>
    <property>
        <name>hadoop.tmp.dir</name> #hadoop运行时产生临时数据的存储目录 
        <value>/data/hadoop_repo/tmp</value> #该目录的地址
    </property>
    <property>
        <name>fs.defaultFS</name> #默认
        <value>hdfs://bigdata1:9000</value> #hdfs的api接口,
    </property>
</configuration>

4、修改hdfs-site.xml 配置

 vi /data/software/hadoop-3.2.0/etc/hadoop/hdfs-site.xml

<configuration>
    <property>
        <name>dfs.namenode.name.secondary.http-address</name>
        <value>bigdata1:50090</value>
    </property>
    <property>
        <name>dfs.replication</name> #设置副本个数
        <value>2</value>
    </property>
</configuration>

5、修改mapred-site.xml 配置

vi /data/software/hadoop-3.2.0/etc/hadoop/mapred-site.xml

<configuration>
    <property>
        <name>mapreduce.framework.name</name>
        <value>yarn</value>
    </property>
</configuration>

6、修改yarn-site.xml配置

vi /data/software/hadoop-3.2.0/etc/hadoop/yarn-site.xml

<configuration>
  <!-- Site specific YARN configuration properties -->
      <property>
          <name>yarn.nodemanager.aux-services</name>
          <value>mapreduce_shuffle</value> #reducer获取数据的方式
      </property>
      <property>
          <name>yarn.resourcemanager.hostname</name>
          <value>bigdata1</value>#指定yarn的老大的地址
      </property>
  </configuration>


7、指定从节点

vi /data/software/hadoop-3.2.0/etc/hadoop/workers

bigdata2
bigdata3

8、修改start-dfs.sh、stop-dfs.sh配置

vi /data/software/hadoop-3.2.0/sbin/start-dfs.sh 

vi /data/software/hadoop-3.2.0/sbin/stop-dfs.sh

在sh脚本开始的地方

HDFS_DATANODE_USER=root
HDFS_DATANODE_SECURE_USER=hdfs
HDFS_NAMENODE_USER=root
HDFS_SECONDARYNAMENODE_USER=root

9、修改start-yarn.sh、stop-yarn.sh配置

 vi /data/software/hadoop-3.2.0/sbin/start-yarn.sh

 vi /data/software/hadoop-3.2.0/sbin/stop-yarn.sh

YARN_RESOURCEMANAGER_USER=root
HADOOP_SECURE_DN_USER=yarn
YARN_NODEMANAGER_USER=root

到此,所有配置都好了。

10、拷贝配置好的hadoop文件到bigdata2和bigdata3

cd /data/software
将配置完的hadoop拷贝到另外两台
scp -rq hadoop-3.2.0 bigdata2:/data/software
scp -rq hadoop-3.2.0 bigdata3:/data/software

所有三台的配置都是一样的

11、bigdata1节点格式化

cd /data/software/hadoop-3.2.0
bin/hdfs namenode -format

12、启动hadoop

格式化成功后,启动

sbin/start-all.sh

查看进程

 查看两个从节点

bigdata2

 bitdata3

这样整个集群就安装成功了

13、停止hadoop

sbin/stop-all.sh