惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

月光博客
月光博客
J
Java Code Geeks
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
P
Proofpoint News Feed
U
Unit 42
B
Blog
宝玉的分享
宝玉的分享
腾讯CDC
Microsoft Azure Blog
Microsoft Azure Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
Last Week in AI
Last Week in AI
博客园 - Franky
博客园 - 三生石上(FineUI控件)
人人都是产品经理
人人都是产品经理
Martin Fowler
Martin Fowler
博客园_首页
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
云风的 BLOG
云风的 BLOG
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
博客园 - 叶小钗

程序员

V2EX 看到讨论"跨域"的帖子,那个她好像回来了 codex 今天真的是不稳定呀。 火山方舟 Coding Plan 慎买 刚问了大家 openclaw 和 hermes 在什么机器上面玩,求推荐一个机器 GPT-image-2 生成 AI 图片防伪有感 codex pro 5 小时限制已经严重缩水 逆天 Antigravity 动态 JSON 序列化对强类型语言很难吗? 自建了 GPT Coding Plan,遇到了定价问题,请教大家 大家都是在什么设备上玩 openclaw 以及 hermes 的呀? 软考还有一个月就考试了,你们学习了吗? 大伙用 AI 会考虑在 user scope 的 CLAUDE.md/AGENTS.md 里交代 AI 说中文吗 我发现程序员这个群体很大部分其实挺抠的 最近使用 cc 总会莫名其妙的返工, codex 不会 目前体验最好的远程 vibe 工具 想知道大佬们抓包遇到 ssl pinning 都是咋优雅的 解决的? 工业软件的大佬们是怎么 vibe coding 的 最近 chrome 是不是有 bug 啊,一搜索就卡住 分布式异步系统在 vibe coding 下的困境 PHP Native AOT 编译器,支持将 PHP 代码编译为可执行文件,运算性能提高 150 倍 没想到 2026 年,还要浪费大量时间在跨域问题上 DeepSeek V4 这周会出吗? 中转站正式试营 欢迎试用 不掺不假 小米 mimo 升级 v2.5,并且重置了额度 Jenkins, SCM 轮询完全不工作是啥问题啊 赛博斗蛐蛐, AI 模型的简单对比(白嫖版) 使用中转站要擦亮眼睛!不说别的,倍率计算 充值好乱。 买了火山的 Coding Plan 测试得出计费模式 给我的 AI 生成了简历和状态卡, 大家帮忙看下 Ta 能找到啥样的
分享 [AI 自动调试失败自动化] Playwright+Testng+ Java 框架
hot63fang · 2026-06-26 · via 程序员
  • 自动化框架:Playwright+Testng+Java

  • 要解决的痛点:目前我们接口+UI 自动化有 6000 来个,每天上班就要跟踪失败的自动化,非常耗时间

  • 办法:半夜 Jenkins job 跑完,让 AI 去接收结果,AI 去改失败的 case ,第二天上班看 AI 的代码 Merge 报告和总结,组员去审核没问题就合入代码

  • 新问题:单个 Job 的 log 非常大,动辄几百 MB 甚至上 GB ,整段塞给 LLM 既废 token 又全是噪音。所以日志要先「瘦身」再进分析

  • 日志瘦身方法: 1 、不依赖 log 做主分析 — 主证据来自结构化的 trace.zip ( artifact ),log 只作辅助定位。 2 、按测试用例边界 / 时间窗口切片 — 用 case 名、FAILED 、时间戳定位失败那一段,只取该 case 的日志窗口(和 trace 解析同一套时间窗口思路)。 3 、只留错误相关 — 抽 error / stacktrace + 失败点前后 N 行上下文,丢掉通过用例和大段 info 噪音。 4 、去重 — 重试/轮询会刷大量重复行,先去重再保留。 5 、token 预算截断 — 进 LL 前按预算截断,保「头 + 尾 + 错误窗口」三段,避免中间无关内容挤占。

整体使用步骤如下:

  • 解析 trace — 按测试用例的时间窗口过滤事件
  • 静态分析 — 扫 error / stacktrace / logs ,形成初步假设
  • 提取证据 — 操作序列、失败详情、DOM 快照、截图、网络请求
  • 截图确认 — 读关键帧(首帧 / 失败前 / 末帧),视觉验证页面状态
  • 自动修复选择器 — DOM 变更导致选择器失效时,从实际 DOM 里找替代选择器并改测试文件
  • 输出根因报告 — 时间线 + 证据链 + 可操作的修复建议

工具内置了对常见失败模式的识别:

模式 症状 根因
A 导航超时 日志出现 navigated to .../pending?redirect=... 应用用了中间跳转页
B Loading 卡住 截图长时间空白,DOM 含 loading-pane React 停在全屏 loading
C 选择器失效 DOM 有内容但目标选择器找不到 CSS class / DOM 结构变更
D API 报错 网络请求 status ≥ 400 后端接口返回错误
E 无响应 网络请求 status = -1 API 请求未收到响应
F PageModel 为 Null 页面对象字段 NPE 选择器未匹配,注入返回 null
ai-autofix-e2e-tests/
├── SKILL.md                 # Claude Code skill 定义(完整 6 步工作流)
├── scripts/
│   ├── parse_trace.py       # 解析 trace.zip ,输出结构化 JSON 报告
│   └── find_selector.py     # 寻找替代选择器并自动修复测试文件
├── docs/
│   └── trace-reference.md   # Playwright trace.zip 格式参考
└── evals/
    └── evals.json           # 评估用例

感兴趣的小伙伴,点击此开源地址