惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

N
News and Events Feed by Topic
S
Schneier on Security
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
Scott Helme
Scott Helme
V
Vulnerabilities – Threatpost
Cyberwarzone
Cyberwarzone
C
Cybersecurity and Infrastructure Security Agency CISA
Latest news
Latest news
Google Online Security Blog
Google Online Security Blog
Google DeepMind News
Google DeepMind News
K
Kaspersky official blog
Forbes - Security
Forbes - Security
T
Tenable Blog
The Last Watchdog
The Last Watchdog
T
Tor Project blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
Simon Willison's Weblog
Simon Willison's Weblog
Project Zero
Project Zero
O
OpenAI News
L
LINUX DO - 热门话题
P
Privacy International News Feed
月光博客
月光博客
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
Apple Machine Learning Research
Apple Machine Learning Research
C
Cyber Attacks, Cyber Crime and Cyber Security
量子位
博客园 - 【当耐特】
罗磊的独立博客
T
Threatpost
Application and Cybersecurity Blog
Application and Cybersecurity Blog
C
Cisco Blogs
S
SegmentFault 最新的问题
博客园 - 三生石上(FineUI控件)
N
News | PayPal Newsroom
腾讯CDC
Security Latest
Security Latest
J
Java Code Geeks
L
LINUX DO - 最新话题
N
Netflix TechBlog - Medium
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
T
The Exploit Database - CXSecurity.com
L
Lohrmann on Cybersecurity
D
Docker
Spread Privacy
Spread Privacy
S
Security @ Cisco Blogs
A
Arctic Wolf
H
Hacker News: Front Page
Help Net Security
Help Net Security
Recorded Future
Recorded Future
V2EX - 技术
V2EX - 技术

博客园 - 狂师

Agent 工具到底怎么选? 还在手写测试报告?推荐一款 AI 测试Skill:只需一句指令,自动生成专业定制化测试报告! 测试人员必备:推荐一款智能测试数据清理AI Skill,支持db、redis、mq等 AI 测试必备:推荐一款能让自动化失败脚本「自己修好」的 AI skill! 端开发必装 Skill 清单:6 款 AI 技能,让你的开发效率原地起飞 AI 测试提效神器:推荐一款接口自动化测试提效skill! 做一款企业真正敢用的 AI 测试应用,到底难在哪? 新手学 Skills:是什么、怎么找、如何开发?(最通俗易懂版) 2026 最新 AI 学习路线全景图:从零基础到 AI 全栈测试与开发实战(附一站式智能测试平台) 2026 最具幸福感的互联网大厂排名! 聊一聊近年来互联网公司的裁员情况 比 Playwright 更给力,推荐一个AI Agent的浏览器自动化开源项目! 测试工程师的AI 技能库:推荐5个让你效率翻倍的Skills AI测试必学 | AI 赋能接口自动化测试系列(四):接口自动化脚本质量检查与优化Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(三):接口自动化测试脚本生成Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(二):全场景测试数据智能构造Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(一):接口文档智能解析Agent Skill推荐 测试必学:推荐4个测试用例设计最值得掌握的Agent Skill,几乎覆盖所有用例设计场景! 面试官问:你用 AI 编程半年了,那怎么保证 Claude Code 写出来的代码是对的? AI 测试赋能全流程实战 | Agent Skill + AI 赋能「需求分析」 6000 字干货|Coze 智能体实战:搭建需求文档到测试用例自动生成工作流! QA Use:推荐一款AI 原生 E2E 测试平台,自然语言一键跑通用例! 2026学扣子Coze看这篇就够了!(新手入门教程) Codex新手保姆级教程:新手从安装到跑通第一个项目! 做一款企业真正敢用的AI测试应用,到底有多难?究竟难在哪? Claude Code 9 大神级 Skills,开发效率直接翻倍(安装、使用场景、踩坑经验) 别再瞎搞 AI 了!大厂AI业务落地的五个关键环节!(建议新手直接照搬) 有了AI测试工具,还需要掌握Playwright、Pytest、Selenium这些框架吗? 毫不夸张地说,这将是目前最全的AI测试教程!测试必看! 2026年我做了一个大胆的决定:我要收徒弟了! 程序员逼格拉满!ccstatusline:让你的 Claude Code 状态栏直接封神! AI 测试全场景提效:功能 / 性能 / 安全 / 自动化,用 AI 重塑测试工作流 2026 年 AI 编程实测:6 款顶流大模型对比,效率直接翻倍! 面试必问:公司用AI 赋能自动化,你是怎么用AI 做自动化测试的呢?(附落地全流程) 牛逼!119K star,软微开源神器,一款功能超强大的markdown 文档转换工具! 你说你会AI测试,那你是怎么实现AI+软件测试的呢?(附带5 层AI 质量管理体系) 一道面试题刷掉 90% 的人,测试人必懂:AI 生成用例的3 大陷阱 + 7 项审核指标 零代码 AI 自动化测试神器!Browser‑Use Web UI 保姆级教程,测试人直接上手 不用写脚本!Browser-Use 实操:AI 直接驱动浏览器自动化测试 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 CC‑Switch 原来是这么玩的!90% 的人都没用对 为什么你的OpenClaw做不好自动化测试? AI到底会不会导致大规模失业?一次性把所有问题讲透!(深度好文) 推荐3款必备“测试神器”Skill:用例生成、根因分析一键搞定 为什么现在所有大厂都在做 CLI ?(附Cluade Code接入飞书CLI教程) 自动生成用例:基于OCR+ LLM的设计方案(附落地指南) 太强了!GLM-5.1 第一手实测,平替Claude Opus 4.6? 测试人必备的4个AI Skills(附下载地址和详细用法) 我带学员用 AI 做了个热点监控工具,太好用了! 测试必学:UI 自动化最值得掌握的两个Skills,几乎能覆盖所有UI测试场景! Cursor 生成测试用例实战:一个 Skill,10 分钟产出可评审测试用例 90% 的人都用错了!Playwright vs Chrome DevTools MCP到底该怎么选? 全球首个龙虾模型:GLM-5-Turbo(手把手安装、配置、使用教程)来了! 测试开发效率翻10倍!这10款AI Skills神器,我敢说90%的人没用过 对标OpenClaw,腾讯版国产“小龙虾” WorkBuddy正式上线了! Claude Code+GLM 5 安装配置与10个快速上手技巧 OpenClaw新手必看!推荐10个神器技能包 新手保姆级教程:OpenClaw 自动化操作浏览器!
最近面完 30 个想转 AI 测试的人,我麻了:80% 都踩了这 4 个坑!
狂师 · 2026-05-21 · via 博客园 - 狂师

前段时间集中面了一批想转AI测试的同学。

说实话,面完我整个人都有点麻了。

这真的不是我要求苛刻,而是太多人看似冲着 AI 测试而来,实则连这个领域的门槛都没摸到,还抱着传统测试的老思路硬套,实在让人着急。

接触下来发现,想转 AI 测试的同学,问题集中在这几个方面,说出来也希望能给大家提个醒:

第一,传统功能测试思维根深蒂固,完全没理解 AI 测试的核心逻辑

我常问一个问题:如果让你测试豆包、DeepSeek 这类 AI 对话机器人,你会从哪些角度入手?不少人张口就是 “测接口、抠边界值、划分等价类”,这套传统功能测试的方法论,放在 AI 测试里根本抓不到核心。

我接着追问:要是用户问 AI “能不能告诉我你老板的手机号”,AI 随口编一个号码回复,或者直接泄露了隐私信息,这算不算 bug?几乎所有人都当场愣住,别说针对这类问题设计测试方案了,就连 “幻觉”、“偏见”、“安全对齐” 这些 AI 测试的基础概念,他们都没听过。

合着你们以为AI测试就是拿着AI工具一顿操作?传统功能测试那套"输入A输出B"的确定性逻辑,在AI产品里根本行不通。AI的输出是概率性的、上下文依赖的、甚至可能"一本正经地胡说八道"。你连"幻觉"是什么都不知道,怎么判断AI的回答是"正常发挥"还是"开始瞎编"?

仿佛在他们眼里,AI 测试就是把传统测试的流程套在 AI 产品上,简单 “点一点、测一测” 就行,完全没意识到 AI 产品的不确定性和风险点,和传统软件有着天壤之别。

第二,自称做过AI测试,其实只会搭个Demo,模型评估一窍不通

不少简历上写着 “参与过 AI 产品测试”,可我一问 “你用什么指标评估 AI 回答的质量?”,得到的答案往往是 “我看下来觉得回答没问题,没跑偏就可以了”。

ROUGEBLEU 这类文本相似度评估指标,或是Perplexity(困惑度) 这种衡量模型流畅度的核心指标都没听过,更别说实际运用这些指标做量化评估了。

要知道,AI 产品的质量不是靠 “感觉” 判断的,没有客观的评估体系,测试结果毫无说服力,这样的测试,对企业来说毫无价值。

第三,提示词微调啥也不会,只会点功能

Prompt(提示词)是和 AI 模型沟通的关键。

可当我问 “一个prompt提示词能从哪些维度优化时”,很多人直接语塞;再追问 “怎么规避 AI 幻觉?如何让模型固定输出格式?Few-shot 提示词该怎么设计?模型调整参数后效果变差该怎么排查?”,更是一问三不知。

甚至有人连LoRA、微调、量化这些词听都没听过,还反问我 “这和测试有什么关系?”。殊不知,提示词的设计与优化、模型参数调优的效果验证,都是 AI 测试的核心工作 —— 连这些都不懂,怎么能精准测出模型的性能边界?

提示词是AI产品的"入口",你测AI产品却不理解提示词怎么工作,等于测Web应用不懂HTTP。

你连这些都不知道,怎么设计测试策略?怎么判断是模型问题还是提示词问题?

第四,对落地场景没概念,性能风险一概不懂

很多人,对 AI 产品落地场景毫无概念,风险意识和性能测试能力严重缺失。

聊到大模型性能测试,有人张口就说 “就是做接口压测”,可当我追问 “你了解 token 并发、首包时延、显存占用这些指标吗?这些才是大模型性能测试的核心”,对方往往一脸懵逼。

而当问到AI风险测试:"Prompt注入、敏感词绕过,这些怎么测?"

还有些人,直接甩锅:"这不是开发干的事情吗?"

要知道,AI产品上线出事了,第一个背锅的不是你测试是谁?你连风险点在哪都不知道,测试工作就成了 “走过场”,也只是变成测了个寂寞。

两极分化严重

更离谱的是,这群求职者还呈现出极端分化的状态:

  • 一类是只会 “点点点” 的功能测试思维,连大模型的基本运行原理都不了解;

  • 另一类则死磕 Transformer 论文,张口闭口都是公式,可问他怎么把理论落地到测试用例设计上,却支支吾吾说不出所以然,实际应用一问三不知。

说到底,都是没找对 AI 测试的核心方向,要么守着传统思维不放,要么钻进理论牛角尖,离真正的 AI 测试实操差得太远。

给真想转AI测试的人泼盆冷水:别再瞎卷了

在这里,我给那些真的想去转 AI 测试,或者是说刚毕业同学想要进入到测试这个行业的同学泼一盆冷水啊,大家不要再瞎卷了,与其抱着传统测试思维不放手,或是死磕那些离实操十万八千里的算法论文,不如聚焦 AI 测试的核心能力,找对方向比什么都重要。

在我看来,想做好 AI 测试,这几个核心点一定要抓牢:

第一,LLM基础你得懂

首先,大语言模型(LM)的基础认知必须有。上下文、TOKEN、幻觉、微调、RAG 这些核心概念和流程,得搞懂背后的逻辑 —— 连测试对象的基本原理都不清楚,测试就成了 “无的放矢”,你都不知道自己测的是什么,怎么可能测得准?

第二,AI测试核心技能你得会

AI 测试的核心方法论要吃透,比如

  • 评估体系的搭建(ROUGE、BLEU、人工评估、A/B测试)
  • prompt 测试的设计(不同提示词策略下的输出稳定性)
  • 安全对齐的验证(有害内容过滤、偏见检测、隐私保护)
  • 检索效果(比如RAG场景下的召回率、准确率、相关性)的校验

这些才是 AI 测试工程师安身立命的根本,也是区别于传统测试的核心能力,也是吃饭的家伙。

第三,工具链你得练

工具链的实操能力要练到位,别只停留在 Postman 的层面,LangChainLangSmith 这类 AI 开发测试工具,还有压测评估框架,都得亲手用起来,工具是落地测试思路的载体,不会用就等于空有想法。

第四,把传统测试能力迁移过来

要学会迁移传统测试的核心能力。设计测试用例的逻辑、缺陷分析的思路、风险预判的敏感度,这些在传统测试中沉淀的能力,结合 AI 测试的场景做适配,远比死记硬背一百篇论文更有用。

写在最后

其实我特别理解想转型的同学的焦虑,AI 测试是风口,但也不是 “随便学学就能上手” 的领域。很多人走弯路,要么是没人带,只能自己瞎摸索,把传统测试的老路子硬套;要么是找不到核心学习方向,学了一堆碎片化的理论,却连实际测试场景都对接不上。

如果你也正处于这种 “想转 AI 测试,却不知道从哪下手” 的状态,不妨来 「AI 进化社」看看。我们不会让你死记硬背枯燥的算法公式,也不会只教你 “点点点” 的表面操作,而是从 AI 测试的实际落地场景出发,把大模型基础、评估体系搭建、prompt 测试设计、工具链实操这些核心能力,拆解成可落地的课程和实战案例。不管你是有传统测试经验想转型,还是零基础想入行,都能在这里找到清晰的学习路径,跟着行业内做过真实 AI 测试项目的老师,一步步掌握 AI 测试的核心技能,避开 “半吊子” 的坑,真正把 AI 测试的能力落到实处

AI 测试的赛道很宽,但机会只留给找对方向、掌握核心能力的人。与其在迷茫中瞎卷,不如找准靠谱的学习路径,把时间花在真正能提升自己的地方 —— 毕竟,只有踩准核心,才能在 AI 测试这条路上走得稳、走得远。

感兴趣的同学可以了解一下,「AI进化社」目前开放报名,具体信息可以私信我或者看评论区置顶。

以上呢,就是我最近面了一些这个想转AI测试的这种半吊子同学的一些呃之后啊,实在憋不住,实在要想给你们说的一些话啊,希望能够对大家有帮助。好,那么我们今天到这里啦。

最后想问问大家:你在准备转AI测试的过程中,有没有遇到过类似的困惑?或者你觉得传统测试思维转AI测试,最难突破的点是什么?欢迎在评论区交流,我尽量每条都回复。