惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

月光博客
月光博客
有赞技术团队
有赞技术团队
S
SegmentFault 最新的问题
宝玉的分享
宝玉的分享
量子位
小众软件
小众软件
The Cloudflare Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
大猫的无限游戏
大猫的无限游戏
C
Check Point Blog
G
Google Developers Blog
博客园 - 叶小钗
H
Help Net Security
Jina AI
Jina AI
Y
Y Combinator Blog
Last Week in AI
Last Week in AI
GbyAI
GbyAI
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
Apple Machine Learning Research
Apple Machine Learning Research
MyScale Blog
MyScale Blog
T
Tailwind CSS Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Vercel News
Vercel News

博客 on 打工人日志

k8s RKE2 cilium L2 + envoy gateway 安装配置 k8s RKE2 vSphere 存储配置 OpenClaw 全能指南:从安装到进阶自动化实战 (2026 最终版) Kubernetes — skywalking + banyanDB APM监控部署 Kubernetes — promtail + loki + grafana 日志系统部署 k8s master 节点 Unauthorized Kubernetes — metalLB + Traefik 部署 Kubernetes — SSL 证书自动更新 Kubernetes — RKE2 + kube-vip + cilium 部署 使用TLSv1.3 升级nginx和openssl Proxmox VE(PVE) 更新到最新版本 kindle 邮件发送失败,错误代码E999 metallb + ingress-nginx + argocd 本地部署 iStoreOS(旁路由)使用openclash实现dns劫持 异常流量分析:图片库服务黑客入侵 openwrt 硬盘扩容 搭建ip地址检索服务 Kubernetes — k8s 手动安装 1.17.9 SELinux 问题:导致端口无法创建,无法访问 【福利】免费!本地部署!去除视频中移动的物体 通知:《打工人日报》迁移到独立板块 KyBook 3 | calibre-web - IOS系统最佳图书伴侣 Tmux 安装和使用教程 DockerHub 加速镜像部署 - 使用cloudflare 代理 docker的零停机部署 SD-webui 批量处理图片 ubuntu 安装 ComfyUI ubuntu 安装 stable-diffusion-webui 测试策略:微服务架构 单元测试:测试单元质量提升
prometheus grafana alertmanager 安装配置
2022-01-13 · via 博客 on 打工人日志

prometheus+grafana+alertmanager 安装配置

服务器监控告警系统搭建,通过 exporter 获取节点信息到 prometheus。prometheus 配置规则,使 garfana 和 alertmanager 能够接受到数据,分别展示数据和发送告警

参数

VM :192.168.99.78

端口服务
9100node_exporter
3000grafana
9090prometheus
9115blackbox_exporter

安装

grafa 安装

  1. docker 安装
1docker run -d -p 3000:3000 \
2--name=grafana \
3-v grafana-storage:/var/lib/grafana \
4grafana/grafana:8.3.3

prometheus 安装

  1. 下载
1wget https://github.com/prometheus/prometheus/releases/download/v2.32.1/prometheus-2.32.1.linux-amd64.tar.gz
2tar -zxvf prometheus-2.32.1.linux-amd64.tar.gz
3cd prometheus-2.32.1.linux-amd64
4mkdir -p file_sd
5mkdir -p rules
  1. 运行 prometheus
1killall prometheus
2nohup ./prometheus --config.file=prometheus.yml &
3# 查看运行状况
4tail -f nohup.out

node_exporter 安装

  1. docker-compose 安装
1version: "3"
2services:
3  node-exporter:
4    image: prom/node-exporter:v1.3.1
5    container_name: node-exporter
6    restart: always
7    ports:
8      - "9100:9100"
  1. 二进制安装
1wget https://github.com/prometheus/node_exporter/releases/download/v1.3.1/node_exporter-1.3.1.linux-amd64.tar.gz
2tar -zxvf node_exporter-1.3.1.linux-amd64.tar.gz
3cd node_exporter-1.3.1.linux-amd64
4nohup ./node_exporter &

blackbox_exporter

  1. 二进制安装
1wget https://github.com/prometheus/blackbox_exporter/releases/download/v0.19.0/blackbox_exporter-0.19.0.linux-amd64.tar.gz
2tar -zxvf blackbox_exporter-0.19.0.linux-amd64.tar.gz
3cd blackbox_exporter-0.19.0.linux-amd64
4nohup ./blackbox_exporter &

Alertmanager

  1. 二进制安装
1wget https://github.com/prometheus/alertmanager/releases/download/v0.23.0/alertmanager-0.23.0.linux-amd64.tar.gz
2tar -zxvf alertmanager-0.23.0.linux-amd64.tar.gz
3cd alertmanager-0.23.0.linux-amd64
4nohup ./alertmanager &
  1. docker-compose 安装
 1version: "3"
 2services:
 3  alertmanager:
 4    image: "prom/alertmanager:v0.22.2"
 5    volumes:
 6      - "/etc/localtime:/etc/localtime"
 7      - "./alertmanager.yml:/etc/alertmanager/alertmanager.yml"
 8    ports:
 9      - "9093:9093"
10    restart: "always"
11    container_name: "alertmanager"

prometheus.yml 配置

 1global:
 2  scrape_interval: 15s # By default, scrape targets every 15 seconds.
 3
 4  # Attach these labels to any time series or alerts when communicating with
 5  # external systems (federation, remote storage, Alertmanager).
 6  external_labels:
 7    monitor: "codelab-monitor"
 8
 9# Alertmanager configuration
10# alerting:
11#   alertmanagers:
12#   - static_configs:
13#     - targets:
14#       - 192.168.99.78:9093
15
16# Load rules once and periodically evaluate them according to the global 'evaluation_interval'.
17# rule_files:
18#   - "./rules/blackbox.yaml"
19#   - "./rules/node-exporter.yaml"
20
21# A scrape configuration containing exactly one endpoint to scrape:
22# Here it's Prometheus itself.
23scrape_configs:
24  # The job name is added as a label `job=<job_name>` to any timeseries scraped from this config.
25  - job_name: "prometheus"
26    # Override the global default and scrape targets from this job every 5 seconds.
27    scrape_interval: 5s
28    static_configs:
29      - targets: ["localhost:9090"]
30
31  - job_name: "node-exporter"
32    file_sd_configs:
33      - files:
34          - "./file_sd/node-exporter.yaml"
35        refresh_interval: 5s
36
37  - job_name: "blackbox"
38    metrics_path: /probe
39    scrape_interval: 30s
40    scrape_timeout: 30s
41    params:
42      module: [http_2xx] # Look for a HTTP 200 response.
43    file_sd_configs:
44      - files:
45          - "./file_sd/blackbox.yaml"
46        refresh_interval: 5s
47    relabel_configs:
48      - source_labels: [__address__]
49        target_label: __param_target
50      - source_labels: [__param_target]
51        target_label: instance
52      - target_label: __address__
53        replacement: 192.168.99.78:9115

node-exporter.yaml

1- targets: ["192.168.99.78:9100"]
2  labels:
3    instance: <实例名称>
4- targets: ["<IP>:9100"]
5  labels:
6    instance: 实例名称

blackbox.yaml

1- targets:
2    - https://www.jobcher.com
3    - https://<域名>