惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
量子位
aimingoo的专栏
aimingoo的专栏
V
Visual Studio Blog
Y
Y Combinator Blog
Vercel News
Vercel News
云风的 BLOG
云风的 BLOG
宝玉的分享
宝玉的分享
Engineering at Meta
Engineering at Meta
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
GbyAI
GbyAI
人人都是产品经理
人人都是产品经理
博客园 - 叶小钗
Stack Overflow Blog
Stack Overflow Blog
大猫的无限游戏
大猫的无限游戏
Microsoft Security Blog
Microsoft Security Blog
B
Blog
Last Week in AI
Last Week in AI
有赞技术团队
有赞技术团队
博客园 - 聂微东
腾讯CDC
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
J
Java Code Geeks

V2EX - 技术

Local-first 软件收录站 从 X 上搬运来的白嫖 GPT Plus 教程 阿里云百炼 Coding Plan Pro 套餐 新增当日 token 限制 大家的 Claude 弹了 kyc 嘛 现在 Google 的 Gemini 和 AI 模式降智的厉害啊 用的 TAG 家的 T, ip 跳变是否影响使用 claude 同一 apple 账户能给不同 claude 账号充值么 做了个 Go 的 MCP Server 框架,一行代码把 Gin API 接入 AI 请教各位,想回归技术,如何系统学习 Agent? OpenAI GPT-IMAGE-2 提示词合集 你是说, claude opus4.6 写代码的能力不如 gpt5.4? 关于智谱 Max 套餐要不要升级续费呢? App → CLI → App ? Github 账号被 404 了,现在没法恢复,求各位大佬指点 cursor 的次数套餐以后应该都用不了新模型了 openrouter 使用国外模型 买了咸鱼低价 Gemini pro,账号差点被盗。突然发现国内诈骗成本为零 Gemini 手机版客户端登陆总是在此国家/地区无法使用 gemini 感觉 gpt 这些低价渠道要爆了 claude code 和 codex 在 vibe coding 还有质的区别吗? 阿里 Coding Plan 一天三变, Lite 版本到期不能续费了 RAG 难以让人满意啊 2026 年了,这个世界还存在互联网精神🥹 两个账号阵亡,尼区 Claude Pro 订阅 分享下最近低价 GPT Codex 的来源(源头) OpenAI 发布 Codex 重大更新:支持自动操作电脑与长期任务自动化 使用 claude 从 0 开始开发一个校友会系统可行吗 同一个 appleid 可以给不同 chatGPT 账号订阅 plus 吗? 自动驾驶项目开发建议 终于, 降智几天之后, opus4.7 出来了
分享 [AI 自动调试失败自动化] Playwright+Testng+ Java 框架
hot63fang · 2026-06-26 · via V2EX - 技术
  • 自动化框架:Playwright+Testng+Java

  • 要解决的痛点:目前我们接口+UI 自动化有 6000 来个,每天上班就要跟踪失败的自动化,非常耗时间

  • 办法:半夜 Jenkins job 跑完,让 AI 去接收结果,AI 去改失败的 case ,第二天上班看 AI 的代码 Merge 报告和总结,组员去审核没问题就合入代码

  • 新问题:单个 Job 的 log 非常大,动辄几百 MB 甚至上 GB ,整段塞给 LLM 既废 token 又全是噪音。所以日志要先「瘦身」再进分析

  • 日志瘦身方法: 1 、不依赖 log 做主分析 — 主证据来自结构化的 trace.zip ( artifact ),log 只作辅助定位。 2 、按测试用例边界 / 时间窗口切片 — 用 case 名、FAILED 、时间戳定位失败那一段,只取该 case 的日志窗口(和 trace 解析同一套时间窗口思路)。 3 、只留错误相关 — 抽 error / stacktrace + 失败点前后 N 行上下文,丢掉通过用例和大段 info 噪音。 4 、去重 — 重试/轮询会刷大量重复行,先去重再保留。 5 、token 预算截断 — 进 LL 前按预算截断,保「头 + 尾 + 错误窗口」三段,避免中间无关内容挤占。

整体使用步骤如下:

  • 解析 trace — 按测试用例的时间窗口过滤事件
  • 静态分析 — 扫 error / stacktrace / logs ,形成初步假设
  • 提取证据 — 操作序列、失败详情、DOM 快照、截图、网络请求
  • 截图确认 — 读关键帧(首帧 / 失败前 / 末帧),视觉验证页面状态
  • 自动修复选择器 — DOM 变更导致选择器失效时,从实际 DOM 里找替代选择器并改测试文件
  • 输出根因报告 — 时间线 + 证据链 + 可操作的修复建议

工具内置了对常见失败模式的识别:

模式 症状 根因
A 导航超时 日志出现 navigated to .../pending?redirect=... 应用用了中间跳转页
B Loading 卡住 截图长时间空白,DOM 含 loading-pane React 停在全屏 loading
C 选择器失效 DOM 有内容但目标选择器找不到 CSS class / DOM 结构变更
D API 报错 网络请求 status ≥ 400 后端接口返回错误
E 无响应 网络请求 status = -1 API 请求未收到响应
F PageModel 为 Null 页面对象字段 NPE 选择器未匹配,注入返回 null
ai-autofix-e2e-tests/
├── SKILL.md                 # Claude Code skill 定义(完整 6 步工作流)
├── scripts/
│   ├── parse_trace.py       # 解析 trace.zip ,输出结构化 JSON 报告
│   └── find_selector.py     # 寻找替代选择器并自动修复测试文件
├── docs/
│   └── trace-reference.md   # Playwright trace.zip 格式参考
└── evals/
    └── evals.json           # 评估用例

感兴趣的小伙伴,点击此开源地址