惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
G
Google Developers Blog
H
Help Net Security
月光博客
月光博客
阮一峰的网络日志
阮一峰的网络日志
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Proofpoint News Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog RSS Feed
爱范儿
爱范儿
酷 壳 – CoolShell
酷 壳 – CoolShell
博客园 - 三生石上(FineUI控件)
大猫的无限游戏
大猫的无限游戏
人人都是产品经理
人人都是产品经理
GbyAI
GbyAI
D
Docker
Hugging Face - Blog
Hugging Face - Blog
I
InfoQ
博客园 - 司徒正美
Last Week in AI
Last Week in AI
Microsoft Security Blog
Microsoft Security Blog
美团技术团队
Stack Overflow Blog
Stack Overflow Blog
M
MIT News - Artificial intelligence

泠泫凝的异次元空间

通过串口安装Linux | 泠泫凝的异次元空间 curl自编译 | 泠泫凝的异次元空间 Minecraft 认证服务器代理 | 泠泫凝的异次元空间 飞塔分流配置实战 | 泠泫凝的异次元空间 Windows 安全启动证书检查 | 泠泫凝的异次元空间 Lxn-OneDriveCLI | 泠泫凝的异次元空间 华三交换机配置 ERPS 环网 | 泠泫凝的异次元空间 PVE 配置 VLAN 感知 | 泠泫凝的异次元空间 MT7922 无线网卡安装 | 泠泫凝的异次元空间 无显示输出 Linux 主机配置桌面显示 | 泠泫凝的异次元空间 Wireguard 部署 SOP 手册(自用) | 泠泫凝的异次元空间 Zabbix 7.4 通过钉钉发送告警提醒 | 泠泫凝的异次元空间 Debian with xfce 通过 VNC 共享屏幕 华三S6860 IRF堆叠 | 泠泫凝的异次元空间 iPad 应用侧载 | 泠泫凝的异次元空间 Smart DNS 分区解析 | 泠泫凝的异次元空间 建立 NFS 服务器并挂载到客户端 | 泠泫凝的异次元空间 将 Android 以 MTP 方式连接至 Debian PVE 虚拟机迁移至 vCenter | 泠泫凝的异次元空间 vCenter 虚拟机迁移至 PVE | 泠泫凝的异次元空间 PVE迁移时提示密钥验证失败 | 泠泫凝的异次元空间 修改Windows设备设置区域 | 泠泫凝的异次元空间 恢复 SecureCRT 7.x 保存的密码 | 泠泫凝的异次元空间 记一次Zabbix异常处理 | 泠泫凝的异次元空间 苹果设备保存SHSH2 | 泠泫凝的异次元空间 PVE超融合部署 | 泠泫凝的异次元空间 树莓派启用zram | 泠泫凝的异次元空间 在 Hyper-V 上安装 EVE-NG | 泠泫凝的异次元空间 Zabbix 部署与 Windows 硬件信息收集 | 泠泫凝的异次元空间 在WSL2中安装CUDA支持 | 泠泫凝的异次元空间
PVE 超融合下电与上电流程 | 泠泫凝的异次元空间
Lxn's Area · 2025-09-26 · via 泠泫凝的异次元空间

主要是处理Ceph的正确下电。

下电

操作前检查

确认Ceph集群状态健康

1
ceph health detail

返回必须且只能是HEALTH_OK严禁带错误下电集群

如果是HEALTH_WARNHEALTH_ERR必须先等待集群恢复或修复错误。

暂停所有可能的IO

将所有虚拟机和CT容器进行关机或暂停处理,防止节点下电后触发HA,也终止对Ceph的IO。

禁止自动恢复

任一节点上执行如下操作:

  1. 防止 OSD 被标记为 out
    1
    ceph osd set noout
  2. 禁止重平衡和自动恢复
    1
    2
    ceph osd set norebalance
    ceph osd set nobackfill
  3. 禁止数据恢复
    1
    ceph osd set norecover
  4. 禁止将节点标记为down
    1
    ceph osd set nodown
  5. 暂停IO
    1
    ceph osd set pause

终止Ceph服务

  1. 每个Monitor节点上停止Mon/Mgr:
    1
    2
    systemctl stop ceph-mon.target
    systemctl stop ceph-mgr.target
  2. 每个节点上停止MDS(CephFS):
    1
    systemctl stop ceph-mds.target
  3. 每个节点上停止OSD:
    1
    systemctl stop ceph-osd.target

硬件下电

  1. 服务器下电:
    1
    shutdown -h now 
  2. 网络设备下电

建议一台一台下电,顺序依照 VM/CT → 纯计算节点 → OSD节点 → Monitor节点 → 网络 顺序进行下电。

上电

操作前检查

确认网络正常,路由可连通,线路连接牢固。

硬件上电

按照顺序依次对硬件进行上电:

网络设备 → Monitor节点 → OSD节点 → 纯计算节点

查看Ceph服务状态

  1. 查看服务是否正确启动:
    1
    systemctl status ceph.target
    我这里看状态正常,服务因为都设置了enable所以可以跟随系统启动。如果有异常需要先处理异常。
  2. 查看集群状态:
    1
    ceph -s
    此时可能会提示Warn,这是正常的。
  3. 解除防止自动恢复标志:
    1
    2
    3
    4
    5
    6
    ceph osd unset pause
    ceph osd unset nodown
    ceph osd unset noout
    ceph osd unset nobackfill
    ceph osd unset norebalance
    ceph osd unset norecover
  4. 查看集群状态:
    1
    ceph -s 
    此时应该还是处于HEALTH_WARN,待一段时间后就会恢复正常。

待ceph状态恢复为HEALTH_OK之后即可启动VM和CT。

 上一篇

SecureCRT