惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

aimingoo的专栏
aimingoo的专栏
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
小众软件
小众软件
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
L
LangChain Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
D
Docker
Cyberwarzone
Cyberwarzone
腾讯CDC
V
Vulnerabilities – Threatpost
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
AWS News Blog
AWS News Blog
GbyAI
GbyAI
Stack Overflow Blog
Stack Overflow Blog
MyScale Blog
MyScale Blog
C
CERT Recently Published Vulnerability Notes
T
Threat Research - Cisco Blogs
S
Securelist
C
Cybersecurity and Infrastructure Security Agency CISA
Security Archives - TechRepublic
Security Archives - TechRepublic
Know Your Adversary
Know Your Adversary
Security Latest
Security Latest
N
News and Events Feed by Topic
Attack and Defense Labs
Attack and Defense Labs
V
Visual Studio Blog
博客园 - 司徒正美
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
I
Intezer
P
Privacy International News Feed
爱范儿
爱范儿
T
The Exploit Database - CXSecurity.com
O
OpenAI News
云风的 BLOG
云风的 BLOG
博客园_首页
雷峰网
雷峰网
M
MIT News - Artificial intelligence
Project Zero
Project Zero
I
InfoQ
Hacker News: Ask HN
Hacker News: Ask HN
C
Cyber Attacks, Cyber Crime and Cyber Security
N
News and Events Feed by Topic
S
Security Affairs
S
Secure Thoughts
Y
Y Combinator Blog
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
美团技术团队
The GitHub Blog
The GitHub Blog
B
Blog
H
Hacker News: Front Page

暗无天日

读:AI Agent 安全日志——从可见性与隐私的两难说起 - 暗无天日 AI写作的语言指纹——如何让文字不那么像机器 - 暗无天日 读:50 条 Claude Code 技巧——一个工程经理的六个月使用心得 读:AI 辅助开发为什么让 E2E 测试更有价值 - 暗无天日 读:在Emacs中使用Claude Code(Spacemacs适配版) - 暗无天日 Claude Code 背后的工程哲学——读 Agent Harness Engineering 读:Agent Harness Engineering——AI 智能体不只是模型,还有套件 - 暗无天日 browser-harness:让 AI 直接接管你的浏览器 - 暗无天日 读:Security-First CI/CD —— DevSecOps 自动化实践指南 TIL: 数字小键盘的小数点陷阱与行内算术求值 - 暗无天日 读:Immutability 不是万能药,它是一种权衡 - 暗无天日 Conducty:给 Claude Code 加上项目记忆和并行执行能力 - 暗无天日 读 — GitHub Trending 里的 Claude Code 技能包 读 — Prompt Caching 省钱指南 TIL: Emacs 中那些跟鼠标配合的冷门快捷键 - 暗无天日 读:Anvil——把 Emacs 变成 AI 的工具服务器 读:Emacs 代码折叠终极指南 - 暗无天日 读:Clojure 搭车客指南 - 暗无天日 git推送失败后恢复仓库损坏的完整记录 - 暗无天日 多智能体系统的两个有效模式——以及对 Claude Code 用户的启示 - 暗无天日 用 Org Babel 写 Literate 博文:扩展执行 + 定制导出 proced:Emacs 内置的进程查看器 - 暗无天日 从 proced 定制中学到的 Elisp 模式 读:让 Emacs proced 在 macOS 上显示 CPU 和内存 异步编程的函数着色税 - 暗无天日 链式调用的代价:JavaScript 和 Clojure 的共同教训 - 暗无天日 hyperfine:命令行基准测试工具 - 暗无天日 管道中的变量去哪了?——子 shell 作用域陷阱 - 暗无天日 开源包装器的信任陷阱:四个危险信号 - 暗无天日 程序员愿意为 AI 写文档,却不愿为同事写 - 暗无天日 mktemp: Shell 脚本中临时文件的安全陷阱与最佳实践 - 暗无天日 WSL9x —— 在 Windows 9x 里跑 Linux 内核 6.19 用 ox.el 做你想做的事 —— org-export 高级编程指南 读:Hot-wiring the Lisp Machine —— 用纯 Elisp 构建零依赖的 Org 静态站点生成器 Elisp 性能优化的六个实战教训 - 暗无天日 fcitx5 下 Emacs 无法切换输入法的排查 - 暗无天日 ERT 测试交互命令的三种方式 - 暗无天日 SEM Assistant: 当 Elisp 守护进程遇上 LLM 用 dmsg 给 Elisp 加上结构化调试日志 用 org-habit 追踪非每日习惯 - 暗无天日 Clojure X-Men:当编程语言特性变成超能力 - 暗无天日 TIL: 用 diff-hl 在 fringe 中显示 git 变更 读:llm-test —— 用 LLM agent 驱动 Emacs 测试 TIL: AI 时代的橡皮鸭调试 - 暗无天日 fcitx 启动后键盘输入卡顿的排查 - 暗无天日 TIL: 早期网页的图片热区导航 - 暗无天日 读 Seeing the Whole System 用 Emacs 自动生成每周链接推荐 - 暗无天日 读:ASCII control characters in my terminal 读 What to learn - 暗无天日 Lisp 的括号之痛——一个愚人节玩笑揭开的老伤疤 - 暗无天日 一本书该"线性读"还是"并行读" - 暗无天日 读 How to Monetize a Blog:一篇伪装成变现指南的讽刺文 Python Mock 第三方依赖的四种策略 - 暗无天日 Emacs Lisp 热重载实用指南 - 暗无天日 Prot 的 Emacs 配置哲学 - 暗无天日 TIL: 从直播对谈中学到的三个 Emacs 技巧 - 暗无天日 TIL: 自动使用项目虚拟环境的 Python - 暗无天日 TIL: 让 Help buffer 自动获得焦点 一条命令让本地开发用上 HTTPS —— slim 工具介绍 用 fsck 检查和修复 Linux 文件系统 排查Linux进程"卡死"实战:从strace到gdb全流程 - 暗无天日 PostgreSQL 索引:从基础到你可能不知道的高级用法 - 暗无天日 用 .pdbrc 自定义 Python 调试器 ANSI 转义码的标准化现状 - 暗无天日 终端程序的潜规则 - 暗无天日 PARA Org-mode 测试配置 - 暗无天日 AI越强越辣鸡?控制论说这是必然的 - 暗无天日 AI 越强越需要你盯着——反馈循环实操指南 - 暗无天日 你的AI代理正在偷你的密钥——四种你没想到的泄露通道 - 暗无天日 LLM 在 DevOps 中的三种角色 - 暗无天日 写作风格的反建议 - 暗无天日 反驳本质复杂性——Dan Luu 论为什么《没有银弹》错了 - 暗无天日 文件充满了危险——Dan Luu 谈文件系统的可靠性陷阱 - 暗无天日 AI 时代的 PARA 方法:用 Org-mode 和 AI 打造个人知识管理系统 Linux 数据去重学习笔记 - 暗无天日 创建跨平台 ZIP 文件的隐藏陷阱:Extra Field - 暗无天日 X11 Forwarding 排障指南 - 暗无天日 IP欺骗端口扫描:当别人冒充你去扫描别人 - 暗无天日 Linux 输入栈全景解析:从硬件按键到屏幕响应 - 暗无天日 Unix 系统中那些被埋没的配置开关——以 FontConfig 为例 - 暗无天日 在Linux上限制儿童使用电脑 - 暗无天日 GIF不仅仅是一种图片格式——用GIF流做些奇怪的事 - 暗无天日 Leiningen 学习笔记:Clojure 项目构建与管理从入门到实战配置 - 暗无天日 Google SRE Book 读书笔记 - 暗无天日 yes 管道 head 发生了什么 - 暗无天日 为什么 nohup 在 crontab 中不起作用 Bash中的Indirection与Nameref - 暗无天日 Linux PAM 简介 - 暗无天日 从Linux ISO文件启动计算机 - 暗无天日 用 Bash 打造一个Screen Locker 用GitHub Actions自动构建EGO博客 - 暗无天日 blocking I/O 的作用 - 暗无天日 mobileog 手机端同步提示Error:2 No such file 的解决方法 回收 WSL2 VHDX 文件占用空间 使用 org-mode columnview 生成任务列表 - 暗无天日 Emacs 作为 MPD 客户端 - 暗无天日 移动文件路径却不破坏org file link的方法 - 暗无天日 如何合理的导出help link 成HTML - 暗无天日 笑话理解之Biology - 暗无天日
读:The Art of Logging——日志规范清单 - 暗无天日
2026-05-04 · via 暗无天日

日志这件事,几乎所有团队都在做,但不是所有团队都做得好。好的日志帮你快速定位问题,坏的日志制造告警疲劳和存储浪费。DZone 上的 The Art of Logging 总结了日志最佳实践,我把要点整理成几条清单,方便对照。

日志级别选择

最常见的错误是什么都打成 ERROR。如果所有东西都是错误,错误信号就没有意义了。

  • INFO :有意义的业务事件或状态变更。用户下单、服务启动、定时任务执行完成。
  • WARN :非预期但已被妥善处理的情况,可能需要关注。第三方接口超时后重试成功、配置项使用了默认值。
  • ERROR :确实需要人工调查的故障。数据库连不上、数据损坏、未捕获的异常。
  • DEBUG :详细的排障信息,线上环境默认关闭。

关键原则:预期会发生的事件不应该打 ERROR。用户输错验证码、下游返回业务校验失败、第三方拒绝请求(因为参数不对),这些都是正常业务逻辑的一部分,记录日志可以,但不该打 ERROR。把预期内的业务失败也打 ERROR,告警系统就会失效,值班工程师也逐渐不再信任告警。

上下文该记什么

一条日志有没有用,取决于它能不能回答这几个问题:发生了什么、在哪发生的、是预期还是异常、有多严重、工程师接下来该查什么。

好的日志上下文包括:

  • 请求 ID 或 trace ID
  • 操作名称(如"支付授权")
  • 服务名称和环境
  • 涉及的外部依赖
  • 失败原因或错误码
  • 关键业务标识(订单号、用户 ID)

看两个例子对比:

  • 差: Error occurred
  • 好: Payment authorization failed for orderId=84219, provider=stripe, reason=card_declined, retryable=false

后者有价值,是因为它把事情说清楚了:哪笔订单哪个环节出了什么问题,工程师看到这条日志可以直接判断怎么处理。

敏感数据清单

上下文有用,但不是什么东西都能往日志里写。以下内容不应该出现在日志中:

  • 密码和 token
  • 完整的信用卡号
  • 个人身份信息(身份证号、手机号、地址)
  • 敏感的业务 payload

记了不该记的东西,轻则违反合规要求,重则数据泄露。判断标准:这条日志如果被第三方看到了,你会不会紧张?

业务失败 vs 系统故障

这是区分日志级别的核心。很多告警系统在这件事上跑偏了。

业务失败(预期内的) :信用卡被拒、密码输错、404(资源不存在)。这些是产品流程中的正常分支,用 INFO 或 WARN 记录,配业务元数据用于分析即可。不需要告警。

系统故障(非预期) :超时、未捕获异常、依赖服务中断、数据损坏。这些需要打 ERROR 并触发告警。

两者的本质区别:前者是你的业务逻辑主动返回的"不行",后者是你的系统"本不该这样"。监控应该把工程注意力引向真正出了问题的地方,而不是业务上不顺的地方。

避免过度记录

过度记录是日志系统退化的最快路径。每个函数调用都记、每个循环迭代都记、每个状态变更都记。那真正有用的信息就会被淹没。搜索变慢、仪表盘变乱、存储成本上升。

加日志之前问自己:

  • 排障时我会搜这条日志吗?
  • 它记录的是有意义的状态变更或决策点吗?
  • 这条日志帮回答"发生了什么"吗?

如果答案都是否,就不该记。

最佳实践要点

最后几条实操建议:

  • 统一格式 :所有日志用相同格式输出,方便解析和查询
  • 结构化日志 :用 JSON 等结构化格式替代纯文本,比用 grep 搜字符串可靠得多
  • 人类可读的 message :结构化的字段留给机器处理,日志正文还是要让人一眼看懂
  • 关联 trace ID :跨服务的调用链靠 trace ID 串联,没有这个标识分布式排障基本靠猜
  • 定期清理噪声 :像重构代码一样定期审查日志,删掉那些已经没用的、过于聒噪的

总结

好的日志只记录重要的事情,而且要说清楚。用正确的级别、带上足够的上下文、区分预期失败和真故障。日志是系统和运维人员沟通的渠道,它不是代码的附属品。

这篇文章列的都是基础原则,不算新鲜。但偶尔翻出来对照一下清单,看看有没有跑偏的地方也不错。