惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Apple Machine Learning Research
Apple Machine Learning Research
Recent Announcements
Recent Announcements
IT之家
IT之家
人人都是产品经理
人人都是产品经理
G
Google Developers Blog
Microsoft Azure Blog
Microsoft Azure Blog
博客园_首页
大猫的无限游戏
大猫的无限游戏
U
Unit 42
罗磊的独立博客
博客园 - Franky
WordPress大学
WordPress大学
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
M
MIT News - Artificial intelligence
SecWiki News
SecWiki News
V
Vulnerabilities – Threatpost
P
Privacy International News Feed
P
Palo Alto Networks Blog
F
Fortinet All Blogs
P
Proofpoint News Feed
博客园 - 叶小钗
C
CERT Recently Published Vulnerability Notes
T
Tor Project blog
Spread Privacy
Spread Privacy
S
Securelist
C
Cisco Blogs
I
Intezer
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Cyberwarzone
Cyberwarzone
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
P
Privacy & Cybersecurity Law Blog
宝玉的分享
宝玉的分享
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Engineering at Meta
Engineering at Meta
S
Schneier on Security
C
CXSECURITY Database RSS Feed - CXSecurity.com
GbyAI
GbyAI
T
Troy Hunt's Blog
T
Threatpost
博客园 - 司徒正美
Y
Y Combinator Blog
Hugging Face - Blog
Hugging Face - Blog
AWS News Blog
AWS News Blog
T
The Blog of Author Tim Ferriss
G
GRAHAM CLULEY
N
Netflix TechBlog - Medium
酷 壳 – CoolShell
酷 壳 – CoolShell
Google DeepMind News
Google DeepMind News
Know Your Adversary
Know Your Adversary
S
SegmentFault 最新的问题

暗无天日

读:AI Agent 安全日志——从可见性与隐私的两难说起 - 暗无天日 AI写作的语言指纹——如何让文字不那么像机器 - 暗无天日 读:50 条 Claude Code 技巧——一个工程经理的六个月使用心得 读:AI 辅助开发为什么让 E2E 测试更有价值 - 暗无天日 读:在Emacs中使用Claude Code(Spacemacs适配版) - 暗无天日 Claude Code 背后的工程哲学——读 Agent Harness Engineering 读:Agent Harness Engineering——AI 智能体不只是模型,还有套件 - 暗无天日 browser-harness:让 AI 直接接管你的浏览器 - 暗无天日 读:Security-First CI/CD —— DevSecOps 自动化实践指南 TIL: 数字小键盘的小数点陷阱与行内算术求值 - 暗无天日 读:Immutability 不是万能药,它是一种权衡 - 暗无天日 Conducty:给 Claude Code 加上项目记忆和并行执行能力 - 暗无天日 读 — GitHub Trending 里的 Claude Code 技能包 读 — Prompt Caching 省钱指南 TIL: Emacs 中那些跟鼠标配合的冷门快捷键 - 暗无天日 读:Anvil——把 Emacs 变成 AI 的工具服务器 读:Emacs 代码折叠终极指南 - 暗无天日 读:Clojure 搭车客指南 - 暗无天日 git推送失败后恢复仓库损坏的完整记录 - 暗无天日 多智能体系统的两个有效模式——以及对 Claude Code 用户的启示 - 暗无天日 用 Org Babel 写 Literate 博文:扩展执行 + 定制导出 proced:Emacs 内置的进程查看器 - 暗无天日 从 proced 定制中学到的 Elisp 模式 读:让 Emacs proced 在 macOS 上显示 CPU 和内存 异步编程的函数着色税 - 暗无天日 链式调用的代价:JavaScript 和 Clojure 的共同教训 - 暗无天日 hyperfine:命令行基准测试工具 - 暗无天日 管道中的变量去哪了?——子 shell 作用域陷阱 - 暗无天日 开源包装器的信任陷阱:四个危险信号 - 暗无天日 程序员愿意为 AI 写文档,却不愿为同事写 - 暗无天日 mktemp: Shell 脚本中临时文件的安全陷阱与最佳实践 - 暗无天日 WSL9x —— 在 Windows 9x 里跑 Linux 内核 6.19 用 ox.el 做你想做的事 —— org-export 高级编程指南 读:Hot-wiring the Lisp Machine —— 用纯 Elisp 构建零依赖的 Org 静态站点生成器 Elisp 性能优化的六个实战教训 - 暗无天日 fcitx5 下 Emacs 无法切换输入法的排查 - 暗无天日 ERT 测试交互命令的三种方式 - 暗无天日 SEM Assistant: 当 Elisp 守护进程遇上 LLM 用 dmsg 给 Elisp 加上结构化调试日志 用 org-habit 追踪非每日习惯 - 暗无天日 Clojure X-Men:当编程语言特性变成超能力 - 暗无天日 TIL: 用 diff-hl 在 fringe 中显示 git 变更 读:llm-test —— 用 LLM agent 驱动 Emacs 测试 TIL: AI 时代的橡皮鸭调试 - 暗无天日 fcitx 启动后键盘输入卡顿的排查 - 暗无天日 TIL: 早期网页的图片热区导航 - 暗无天日 读 Seeing the Whole System 用 Emacs 自动生成每周链接推荐 - 暗无天日 读:ASCII control characters in my terminal 读 What to learn - 暗无天日 Lisp 的括号之痛——一个愚人节玩笑揭开的老伤疤 - 暗无天日 一本书该"线性读"还是"并行读" - 暗无天日 读 How to Monetize a Blog:一篇伪装成变现指南的讽刺文 Python Mock 第三方依赖的四种策略 - 暗无天日 Emacs Lisp 热重载实用指南 - 暗无天日 Prot 的 Emacs 配置哲学 - 暗无天日 TIL: 从直播对谈中学到的三个 Emacs 技巧 - 暗无天日 TIL: 自动使用项目虚拟环境的 Python - 暗无天日 TIL: 让 Help buffer 自动获得焦点 一条命令让本地开发用上 HTTPS —— slim 工具介绍 用 fsck 检查和修复 Linux 文件系统 排查Linux进程"卡死"实战:从strace到gdb全流程 - 暗无天日 PostgreSQL 索引:从基础到你可能不知道的高级用法 - 暗无天日 用 .pdbrc 自定义 Python 调试器 ANSI 转义码的标准化现状 - 暗无天日 终端程序的潜规则 - 暗无天日 PARA Org-mode 测试配置 - 暗无天日 AI越强越辣鸡?控制论说这是必然的 - 暗无天日 AI 越强越需要你盯着——反馈循环实操指南 - 暗无天日 你的AI代理正在偷你的密钥——四种你没想到的泄露通道 - 暗无天日 LLM 在 DevOps 中的三种角色 - 暗无天日 写作风格的反建议 - 暗无天日 反驳本质复杂性——Dan Luu 论为什么《没有银弹》错了 - 暗无天日 文件充满了危险——Dan Luu 谈文件系统的可靠性陷阱 - 暗无天日 AI 时代的 PARA 方法:用 Org-mode 和 AI 打造个人知识管理系统 Linux 数据去重学习笔记 - 暗无天日 创建跨平台 ZIP 文件的隐藏陷阱:Extra Field - 暗无天日 X11 Forwarding 排障指南 - 暗无天日 IP欺骗端口扫描:当别人冒充你去扫描别人 - 暗无天日 Linux 输入栈全景解析:从硬件按键到屏幕响应 - 暗无天日 Unix 系统中那些被埋没的配置开关——以 FontConfig 为例 - 暗无天日 在Linux上限制儿童使用电脑 - 暗无天日 GIF不仅仅是一种图片格式——用GIF流做些奇怪的事 - 暗无天日 Leiningen 学习笔记:Clojure 项目构建与管理从入门到实战配置 - 暗无天日 Google SRE Book 读书笔记 - 暗无天日 yes 管道 head 发生了什么 - 暗无天日 为什么 nohup 在 crontab 中不起作用 Bash中的Indirection与Nameref - 暗无天日 Linux PAM 简介 - 暗无天日 从Linux ISO文件启动计算机 - 暗无天日 用 Bash 打造一个Screen Locker 用GitHub Actions自动构建EGO博客 - 暗无天日 blocking I/O 的作用 - 暗无天日 mobileog 手机端同步提示Error:2 No such file 的解决方法 回收 WSL2 VHDX 文件占用空间 使用 org-mode columnview 生成任务列表 - 暗无天日 Emacs 作为 MPD 客户端 - 暗无天日 移动文件路径却不破坏org file link的方法 - 暗无天日 如何合理的导出help link 成HTML - 暗无天日 笑话理解之Biology - 暗无天日
读:把成本当作 SLI - 暗无天日
2026-05-08 · via 暗无天日

做法不复杂:像盯延迟一样盯成本。把 cost-per-request 拉出来,设基线,设告警,让它也能触发值班。

成本的数据原料其实都有:请求数有、执行时长有、内存配置有、出口字节有。大多数团队缺的不是数据,是把这些数据拼起来持续计算、然后接入告警管道的习惯。

原文给了一条 Prometheus 告警规则,就是最直接的做法:

- alert: CostPerRequestAnomaly
  expr: |
    (
      increase(cloud_spend_dollars_total{service="payment-processor"}[30m])
      /
      increase(http_requests_total{service="payment-processor"}[30m])
    ) > 0.02
  for: 15m
  labels:
    severity: warning
  annotations:
    summary: "Payment processor cost/request exceeding $0.02 threshold"
    runbook: "https://wiki.internal/runbooks/cost-anomaly"

这条规则的意思是:过去 30 分钟内,支付服务的每请求成本超过 $0.02 并且持续 15 分钟,就触发告警。实际落地需要处理几个边界:请求量降到零时分母为零怎么办、固定成本(跟请求量无关的部分)怎么单独核算、每个服务的阈值需要各自调。原则没有问题。

国内平台可以用阿里云的 cloud-exporter 把费用数据接入 Prometheus,或者直接用费用中心 API 拉数据写入自建监控。

在接好完整的 Prometheus 流水线之前,最基本的计算逻辑用一段 Shell 就能说明白:

bashset -euo pipefail

cat > /tmp/cost_data.csv <<'CSVEOF'
timestamp,requests,cost
08:00,1000,12.50
08:05,1100,13.00
08:10,1050,12.80
08:15,1200,13.50
08:20,1150,13.20
08:25,1000,12.50
08:30,1300,35.00
08:35,1250,33.00
08:40,1350,36.50
08:45,1400,38.00
08:50,1200,32.00
08:55,1100,30.00
CSVEOF

BASELINE=0.012  THRESHOLD=$(awk "BEGIN {print $BASELINE * 2}")

echo "=== cost-per-request 监控演示 ==="
echo "基线: \$${BASELINE}/request,告警阈值: \$${THRESHOLD}/request(基线 × 2)"
echo ""

tail -n +2 /tmp/cost_data.csv | while IFS=, read -r ts req cost; do
  cpr=$(awk "BEGIN {printf \"%.4f\", $cost / $req}")
  if awk -v cpr="$cpr" -v thresh="$THRESHOLD" 'BEGIN {exit !(cpr > thresh)}'; then
    printf "  %s  req=%s  cost=\$%-6s  cpr=\$%s  ← 超过阈值!\n" "$ts" "$req" "$cost" "$cpr"
  else
    printf "  %s  req=%s  cost=\$%-6s  cpr=\$%s\n" "$ts" "$req" "$cost" "$cpr"
  fi
done

echo ""
echo "08:30 开始 cpr 翻倍。排查方向:"
echo "  1. 新部署是否引入了 N+1 查询"
echo "  2. 索引被误删导致全表扫描"
echo "  3. Serverless 函数是否有 retry storm"
echo "  4. 是否有人在跨 region 拉数据"
=== cost-per-request 监控演示 ===
基线: $0.012/request,告警阈值: $0.024/request(基线 × 2)

  08:00  req=1000  cost=$12.50   cpr=$0.0125
  08:05  req=1100  cost=$13.00   cpr=$0.0118
  08:10  req=1050  cost=$12.80   cpr=$0.0122
  08:15  req=1200  cost=$13.50   cpr=$0.0112
  08:20  req=1150  cost=$13.20   cpr=$0.0115
  08:25  req=1000  cost=$12.50   cpr=$0.0125
  08:30  req=1300  cost=$35.00   cpr=$0.0269  ← 超过阈值!
  08:35  req=1250  cost=$33.00   cpr=$0.0264  ← 超过阈值!
  08:40  req=1350  cost=$36.50   cpr=$0.0270  ← 超过阈值!
  08:45  req=1400  cost=$38.00   cpr=$0.0271  ← 超过阈值!
  08:50  req=1200  cost=$32.00   cpr=$0.0267  ← 超过阈值!
  08:55  req=1100  cost=$30.00   cpr=$0.0273  ← 超过阈值!

08:30 开始 cpr 翻倍。排查方向:
  1. 新部署是否引入了 N+1 查询
  2. 索引被误删导致全表扫描
  3. Serverless 函数是否有 retry storm
  4. 是否有人在跨 region 拉数据

实际使用时,把模拟数据换成云厂商账单 API 的返回值,加到 cron 里每 5 分钟跑一次。成本异常就能在第一个 30 分钟窗口内收到告警,不用等到月底对账。