惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
T
Troy Hunt's Blog
博客园 - 【当耐特】
N
Netflix TechBlog - Medium
V
V2EX
I
InfoQ
量子位
Hugging Face - Blog
Hugging Face - Blog
The Register - Security
The Register - Security
J
Java Code Geeks
V
Visual Studio Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
S
Security @ Cisco Blogs
爱范儿
爱范儿
Hacker News: Ask HN
Hacker News: Ask HN
Recent Commits to openclaw:main
Recent Commits to openclaw:main
B
Blog
Apple Machine Learning Research
Apple Machine Learning Research
V2EX - 技术
V2EX - 技术
罗磊的独立博客
S
Security Affairs
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
IT之家
IT之家
O
OpenAI News
W
WeLiveSecurity
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
GbyAI
GbyAI
The Hacker News
The Hacker News
Attack and Defense Labs
Attack and Defense Labs
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Microsoft Azure Blog
Microsoft Azure Blog
F
Fortinet All Blogs
Schneier on Security
Schneier on Security
雷峰网
雷峰网
Scott Helme
Scott Helme
B
Blog RSS Feed
有赞技术团队
有赞技术团队
Recent Announcements
Recent Announcements
L
LangChain Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Y
Y Combinator Blog
Help Net Security
Help Net Security
NISL@THU
NISL@THU
A
About on SuperTechFans
L
LINUX DO - 最新话题
博客园 - 司徒正美
博客园 - 聂微东
博客园 - 三生石上(FineUI控件)
Spread Privacy
Spread Privacy
P
Proofpoint News Feed

程序员

V2EX 看到讨论"跨域"的帖子,那个她好像回来了 codex 今天真的是不稳定呀。 火山方舟 Coding Plan 慎买 刚问了大家 openclaw 和 hermes 在什么机器上面玩,求推荐一个机器 GPT-image-2 生成 AI 图片防伪有感 codex pro 5 小时限制已经严重缩水 逆天 Antigravity 动态 JSON 序列化对强类型语言很难吗? 自建了 GPT Coding Plan,遇到了定价问题,请教大家 大家都是在什么设备上玩 openclaw 以及 hermes 的呀? 软考还有一个月就考试了,你们学习了吗? 大伙用 AI 会考虑在 user scope 的 CLAUDE.md/AGENTS.md 里交代 AI 说中文吗 我发现程序员这个群体很大部分其实挺抠的 最近使用 cc 总会莫名其妙的返工, codex 不会 目前体验最好的远程 vibe 工具 想知道大佬们抓包遇到 ssl pinning 都是咋优雅的 解决的? - V2EX 工业软件的大佬们是怎么 vibe coding 的 - V2EX 最近 chrome 是不是有 bug 啊,一搜索就卡住 - V2EX 分布式异步系统在 vibe coding 下的困境 PHP Native AOT 编译器,支持将 PHP 代码编译为可执行文件,运算性能提高 150 倍 没想到 2026 年,还要浪费大量时间在跨域问题上 - V2EX DeepSeek V4 这周会出吗? 中转站正式试营 欢迎试用 不掺不假 小米 mimo 升级 v2.5,并且重置了额度 Jenkins, SCM 轮询完全不工作是啥问题啊 赛博斗蛐蛐, AI 模型的简单对比(白嫖版) 使用中转站要擦亮眼睛!不说别的,倍率计算 充值好乱。 买了火山的 Coding Plan 测试得出计费模式 给我的 AI 生成了简历和状态卡, 大家帮忙看下 Ta 能找到啥样的 腾讯云太不要脸了, token plan 上 glm5.1 和 minimax-m2.7,但是 coding plan 不上 - V2EX 目前自建梯子最强的 anytls 协议不是不不更新了? 刚发现 WSL2 可以通过 virtiofs 访问 NTFS 分区, IO 速度明显提升 v2board 还是其它面板更适合小团伙使用? 现在 AI 来了,如果有天不需要程序员? gpt-image-2 太顶了 你们 vibe 会让模型先输出方案来审核吗? GLM Coding Plan 调整老套餐并停止自动续订,受影响用户获赠 2 个月新套餐权益 为了浏览在线文档的时候能自定义高亮, Vibe 了一个网页高亮标记的工具 从 2 月开始用 Opus 4.6,到这几天切到 4.7,一些感悟和困惑 Github Copilot 停售之后还能买什么 收集了一下市面上常见的 Token Plan,可以给到大家一点参考 这个生图太牛了 中国的算力缺口这么大嘛?看到 2025 华为昇腾出货 81 万块,又看到各家 coding plan 不是停售就是限流 做 OPC 太难了,天天焦虑 阿里云 Coding Plan 增加动态限流,频繁暂停无法使用 马斯克 600 亿美元收购 Cursor codex 开始灰度 GPT 5.5 了 大家是如何使用 codex gpt-image-2 生图确实很顶啊,附带几张生成效果。 codex 的风评似乎在超过 Claude code? 智谱 GLM 宣布停止续订无周限额的老套餐 如何实现自我进化的 AI 的 Skills? 智谱(GLM)果然学习了阿里, 强制关闭了老用户套餐的自动续费 各位公司有除了智能客服外真正落地的 AI 应用吗? 热烈欢迎火山 Coding Plan 加入 GLM5.1 Kimi2.6 MiniMax2.7 阵容 请教大佬: claude API token 太烧钱了, minmax 还要兑换码,有没有合适的中转方案 开发一个面向普通用户(非程序员)的 Agent 软件,支持 skills、定时任务、对话功能,主要客户群体使用 Windows。感觉像是一个带前端的 Hermes,但是 Hermes 在 Windows 下运行不太友好,不适合非开发人员。 grok XAI 开始限制免费用户访问次数了吗? openspec 怎么配合 superpowers 使用? 阿里云的 coding plan 莫名奇妙被冻结了 程序员如何学习 ui 审美 开源了一个 AI Agent 认证工具 sig —— 让 AI Agent 安全访问外部系统 Vibe Coding 时代,该如何快速搭建一个 CRUD 平台? 感觉大多数的 coding plan 都是被龙虾薅死的。 有没有一起拼中转站的呀,找到一个中转站用了段时间感觉比较靠谱 搭个 AI 中转玩玩 Zeabur + Neon 50 块以内跑通 Coinepay:一张不能用的卡,扣了我 5 个月月费 Gemini in Chrome 支持日本了,为什么我的不生效? 跳板机/内网穿透方案,如何降低远程访问校内服务器延时? 现在有没有什么好的 AI 图片生成 3D 模型的方案? 关于科研 ai 作图 为什么现在 AI SDK 默认不支持异步? 建议 V2EX 加入一个 Ai App 或者 Vibe Coding 模块,把一堆 Ai 生成的产品都丢进去。 如果没用 coding plan 套餐了,再继续自费上班是不是就太傻了 AI 太烧钱了,有什么好的大模型组合方案? 阿里云百炼这波开始割韭菜了,下架 coding plan,改头换面 token plan 最新,腾讯云和阿里云 coding plan 购买页面均已下架,换成了 token plan 阿里云 CodingPlan 彻底没了,新上了 TokenPlan 大家看到 antigravity 那个配额监视器的广告了没? 真心发问,想学后端需要学啥? AI-Powered Log Analysis Tool - Pangu RCA 想自己写一个 code agent 玩玩,有什么开源项目可以参考吗? 腾讯云 Coding Plan 下架了 现在还有哪一个国产 Coding Plan 能买到吗? 106 行业短信签名申请新规范出台, 5 月 1 日起生效 最近上线了一个开发了半年的 shopify SAAS AI 就像那渣男渣女,平时哄着你温柔小意,关键时刻就坑你一波大的 大家在开发智能体时,都是怎么写系统提示词的? 现在大模型国内外直连越来越难买或拼车了,想试试中转站,大家有没什么推荐呀 一个人写了大半年 Android App,聊聊过程中的一些取舍,第二篇 智谱 coding plan 的使用 token 限制是多少? cli-proxy-api + 中转站领的鸡蛋 = 大模型免费用是否可行? gpt coding plan 一天试用(GPT 5.3codex 和 gpt 5.4) 大家用 AI 是订阅制多还是 API 按量付费多? 我用 AI 写了一个游戏,我发现我不想看代码,也看不懂代码了 AI 代码后面怎么维护,心智负担太大了 中年人爱上 AI 编程,就像爱上钓鱼 每月 AI 支出都超过生活费了 1000 行 rust 实现一个类似于 pytorch 的轻量级自动微分库
找到问题的本质在于找到本质的问题
LDa · 2026-06-14 · via 程序员

前言

最近 VC 玩多了,回来聊聊工程问题

找到问题的本质在于找到本质的问题

这句话乍看之下是打机锋,但却是提高工程质量的一个切实方法。很多时候,真正阻碍质量提升的不是缺少答案,而是问错了问题。 一个线上接口变慢了,我们问:“怎么优化这个接口?”
这不是个好问题,应该继续追问:
1.为什么只有管理用户慢?
2.为什么只在每天 9 点半到 11 点慢?
3.为什么数据库没有变慢,但接口耗时增加了?
4.为什么缓存命中率下降没有触发告警
...

现象不是问题

工程现场最常见的误判,是把现象当成问题。 比如:页面白屏了。 此时简单的修复可能是单纯地拉长等待时间或者给个兜底值。

但如果我们继续追问:
1.是所有用户白屏,还是部分用户?
2.是首次加载白屏,还是路由跳转后白屏?
3.是前端资源加载失败,还是运行时报错?
4.是发布后立刻出现,还是某个接口返回特定数据后出现?

问题会逐渐变形,从最开始我们以为是渲染问题,逐渐会发现真正的问题,它可能是: 某个接口新增字段为 null,前端组件没有做空值防御,导致渲染阶段抛错,中断了整个应用挂载流程。 这时,解决方式也从“看看页面为什么白屏”,变成了更精确的技术动作,比如补充字段兼容逻辑,收敛接口契约,增加边界数据测试,增加前端错误隔离,后台增加数据校验等...

好问题会缩小搜索空间

比如在我最近开发的一个基于 tauri 桌面端 AI 插件里,最容易出现的一个问题就是 为什么回写结果不稳定?

这个问题太大了,整个项目成千上万个文件,它把全部可能性都混在一起,根本无从下手。

更精确的问题应该是:

为什么第三方系统调用 /api/task/assist 进入辅助模式后,用户点击“确认同步”已经产生了 record-confirmed 事件,但第三方系统回执后页面没有更新为同步成功,而且只发生在同一对象多次打开、请求里没有传 sessionId / visitId 这类唯一上下文标识的场景?

这种问题一下子就把搜索空间(上下文)缩小了。

拿这个问题举例拆解一下边界:
1 。 时间边界:用户点击“确认同步”之后,第三方系统回执之后
2. 入口边界:本地 Bridge 的 /api/task/assist
3. 流程边界:辅助模式,不是完整流程,也不是独立窗口
4. 事件边界:已产生 record-confirmed,问题只在回写阶段
5. 数据边界:同一对象多次打开、缺少唯一上下文标识
6. 排除项:不是远端模型接口、不是网络认证、不是生成响应慢
7. 可能方向:结果事件匹配、回执更新、旧会话缓存污染

此时排查链路就变得非常明确

第三方系统 /api/task/assist
→ 前端进入 AI 辅助模式
→ 用户确认同步
→ 生成 record-confirmed
→ 第三方系统处理同步内容
→ 第三方系统调用 feedback 回执
→ 桌面端按上下文 ID 更新页面状态

最后发现本质的问题是 : 在同一对象多次打开的场景下,如果第三方系统没有传唯一上下文标识,桌面端会回退使用对象 ID 作为匹配锚点(我又来吐槽 codex 的兜底习惯了,这时候要你兜底吗!),导致不同会话共享同一个结果匹配键,旧会话的结果或回执可能误命中新会话。

于是解决方案也清晰了: 所有入口都优先传入唯一上下文标识;文档中明确“同一对象多次打开”必须传会话级 ID ;联调时用会话 ID 串起整个调用链,验证每一步的上下文 ID 是否一致。

这个挖掘过程能很好的说明一个好的问题是一个边界清楚的问题,它把“结果同步不稳定”收敛成一个可验证可修复的“没有严格透传一个会话级主键”

别猜,要体系化地追问

我刚入行时,我领导经常教育我,排查问题别靠猜,后来我把他的排查思路固化成一个实用的追问模型,这里直接用 gpt 生成一个图片来解释,大家可以拷贝去多看多想: 追问

⚠️ 与 ✅

技术判断中有三个危险信号

第一 问题描述里只有情绪,没有量化事实,例如:
很慢/老是失败/不稳定
这类描述需要被指标化:
从原先耗时多少到现在耗时多少,慢了多少
失败率有多少
什么场景下必现失败
与哪个版本对比

第二 过早给出原因
肯定是数据库问题/应该是缓存没生效/可能是网络抖动
经验有价值,但经验也会制造偏见。更稳妥的方式是把判断写成假设,然后验证它。

第三,只问“怎么修”,不问“为什么存在”。
如果一个问题反复出现,说明它不是单点问题,而是系统机制问题。
比如重复出现字段兼容 bug ,真正要做的可能不是继续补判空,而是建立接口契约、类型生成、mock 数据、回归测试和灰度验证。

一个判断本质问题的标准

在工程里,一个问题是否接近本质可以看它是否满足以下三点:
1.能解释当前现象
2.能预测类似现象
3.能指导结构性改进

举个后端同学常见的例子:
这次接口慢是因为 SQL 没加索引
但更本质的问题是:
当前没有针对高频查询建立性能基线和索引评审机制,导致数据量增大后性能风险只能在线上暴露。
前者解决当前故障,后者还能避免后续发生

结语

定义一个问题在当下更是一个核心能力,这篇文章希望能对大家后续日常编程或者 VibeCoding 时有帮助,前者省时,后者省 token
不用一蹴而就,这本就是需要时间和经验慢慢打磨的能力。