惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Tailwind CSS Blog
大猫的无限游戏
大猫的无限游戏
L
LINUX DO - 热门话题
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
雷峰网
雷峰网
aimingoo的专栏
aimingoo的专栏
博客园_首页
MongoDB | Blog
MongoDB | Blog
V
V2EX
GbyAI
GbyAI
量子位
Microsoft Azure Blog
Microsoft Azure Blog
有赞技术团队
有赞技术团队
G
Google Developers Blog
云风的 BLOG
云风的 BLOG
B
Blog
Microsoft Security Blog
Microsoft Security Blog
S
SegmentFault 最新的问题
O
OpenAI News
N
News and Events Feed by Topic
博客园 - Franky
爱范儿
爱范儿
Forbes - Security
Forbes - Security
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
V2EX - 技术
V2EX - 技术
Application and Cybersecurity Blog
Application and Cybersecurity Blog
N
News and Events Feed by Topic
N
News | PayPal Newsroom
Schneier on Security
Schneier on Security
Cloudbric
Cloudbric
Security Archives - TechRepublic
Security Archives - TechRepublic
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
Recent Commits to openclaw:main
Recent Commits to openclaw:main
人人都是产品经理
人人都是产品经理
P
Privacy International News Feed
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog RSS Feed
阮一峰的网络日志
阮一峰的网络日志
D
DataBreaches.Net
Last Week in AI
Last Week in AI
罗磊的独立博客
Spread Privacy
Spread Privacy
Recent Announcements
Recent Announcements
The Cloudflare Blog
Google DeepMind News
Google DeepMind News
AWS News Blog
AWS News Blog
The Register - Security
The Register - Security
Y
Y Combinator Blog
J
Java Code Geeks
I
Intezer

博客园 - 狂师

从 LLM 评测到 AI Agent 评测,我的一些思考! 测试开发必备的 AI 技能库:推荐6 个让接口自动化测试效率翻倍的 Skills 推荐一款开源工具:让 AI Agent 替你做 iOS、Android 自动化测试,能平替 Appium? AI 测试必备:多Agent Skill 智能编排,从「脚本执行」到「失败自愈」到「报告生成」,一键跑通全流程! 10万人都在用的 top10 skills,我帮你试了! Agent 工具到底怎么选? 还在手写测试报告?推荐一款 AI 测试Skill:只需一句指令,自动生成专业定制化测试报告! 测试人员必备:推荐一款智能测试数据清理AI Skill,支持db、redis、mq等 AI 测试必备:推荐一款能让自动化失败脚本「自己修好」的 AI skill! 端开发必装 Skill 清单:6 款 AI 技能,让你的开发效率原地起飞 AI 测试提效神器:推荐一款接口自动化测试提效skill! 做一款企业真正敢用的 AI 测试应用,到底难在哪? 新手学 Skills:是什么、怎么找、如何开发?(最通俗易懂版) 2026 最新 AI 学习路线全景图:从零基础到 AI 全栈测试与开发实战(附一站式智能测试平台) 2026 最具幸福感的互联网大厂排名! 聊一聊近年来互联网公司的裁员情况 比 Playwright 更给力,推荐一个AI Agent的浏览器自动化开源项目! 测试工程师的AI 技能库:推荐5个让你效率翻倍的Skills AI测试必学 | AI 赋能接口自动化测试系列(四):接口自动化脚本质量检查与优化Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(三):接口自动化测试脚本生成Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(二):全场景测试数据智能构造Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(一):接口文档智能解析Agent Skill推荐 测试必学:推荐4个测试用例设计最值得掌握的Agent Skill,几乎覆盖所有用例设计场景! AI 测试赋能全流程实战 | Agent Skill + AI 赋能「需求分析」 6000 字干货|Coze 智能体实战:搭建需求文档到测试用例自动生成工作流! QA Use:推荐一款AI 原生 E2E 测试平台,自然语言一键跑通用例! 2026学扣子Coze看这篇就够了!(新手入门教程) Codex新手保姆级教程:新手从安装到跑通第一个项目! 做一款企业真正敢用的AI测试应用,到底有多难?究竟难在哪? Claude Code 9 大神级 Skills,开发效率直接翻倍(安装、使用场景、踩坑经验) 别再瞎搞 AI 了!大厂AI业务落地的五个关键环节!(建议新手直接照搬) 有了AI测试工具,还需要掌握Playwright、Pytest、Selenium这些框架吗? 毫不夸张地说,这将是目前最全的AI测试教程!测试必看! 最近面完 30 个想转 AI 测试的人,我麻了:80% 都踩了这 4 个坑! 2026年我做了一个大胆的决定:我要收徒弟了! 程序员逼格拉满!ccstatusline:让你的 Claude Code 状态栏直接封神! AI 测试全场景提效:功能 / 性能 / 安全 / 自动化,用 AI 重塑测试工作流 2026 年 AI 编程实测:6 款顶流大模型对比,效率直接翻倍! 面试必问:公司用AI 赋能自动化,你是怎么用AI 做自动化测试的呢?(附落地全流程) 牛逼!119K star,软微开源神器,一款功能超强大的markdown 文档转换工具! 你说你会AI测试,那你是怎么实现AI+软件测试的呢?(附带5 层AI 质量管理体系) 一道面试题刷掉 90% 的人,测试人必懂:AI 生成用例的3 大陷阱 + 7 项审核指标 零代码 AI 自动化测试神器!Browser‑Use Web UI 保姆级教程,测试人直接上手 不用写脚本!Browser-Use 实操:AI 直接驱动浏览器自动化测试 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 CC‑Switch 原来是这么玩的!90% 的人都没用对 为什么你的OpenClaw做不好自动化测试? AI到底会不会导致大规模失业?一次性把所有问题讲透!(深度好文) 推荐3款必备“测试神器”Skill:用例生成、根因分析一键搞定 为什么现在所有大厂都在做 CLI ?(附Cluade Code接入飞书CLI教程) 自动生成用例:基于OCR+ LLM的设计方案(附落地指南) 太强了!GLM-5.1 第一手实测,平替Claude Opus 4.6? 测试人必备的4个AI Skills(附下载地址和详细用法) 我带学员用 AI 做了个热点监控工具,太好用了! 测试必学:UI 自动化最值得掌握的两个Skills,几乎能覆盖所有UI测试场景! Cursor 生成测试用例实战:一个 Skill,10 分钟产出可评审测试用例 90% 的人都用错了!Playwright vs Chrome DevTools MCP到底该怎么选? 全球首个龙虾模型:GLM-5-Turbo(手把手安装、配置、使用教程)来了! 测试开发效率翻10倍!这10款AI Skills神器,我敢说90%的人没用过 对标OpenClaw,腾讯版国产“小龙虾” WorkBuddy正式上线了! Claude Code+GLM 5 安装配置与10个快速上手技巧 OpenClaw新手必看!推荐10个神器技能包 新手保姆级教程:OpenClaw 自动化操作浏览器!
面试官问:你用 AI 编程半年了,那怎么保证 Claude Code 写出来的代码是对的?
狂师 · 2026-06-15 · via 博客园 - 狂师

前两天刷知乎的时候,看到一个很有意思的帖子,标题叫:《面试官问:你用 AI 编程半年了,那怎么保证 Claude Code 写出来的代码是对的?》

翻完评论区,我没有找到特别满意的答案,反而越发有感触。

借着这个话题,今天来简单聊聊。

不知道正在看文章的你,还记不记得自己第一次体验 Vibe Coding 的感受?相信应该没人能忘吧。

不用抠语法、不用写重复的模板代码、不用对着文档查API。只需要敲一段自然语言描述,AI 就能瞬间吐出一大段工整、能运行、结构规整的代码,那种感觉太上瘾了。

但半年、一年过去,热潮褪去,再回头看看Vibe Coding,也多了几分理性与思考,心境早已和当初截然不同。

1、先搞懂:大部分人理解的 Vibe Coding,本身就是错的

这两年爆火的Vibe Coding(氛围编程),很多人简单理解:“就是用AI帮你写代码”,圈内甚至流传着一句调侃:现在编程门槛越来越低了,你只要会说话,就能写出代码。

现实中,绝大多数人使用AI 编码 的工作流,基本都是这样:

flowchart LR A[拿到需求] --> B[丢给AI生成代码] B --> C[复制粘贴代码] C --> D[本地运行验证] D --> E{运行结果?} E -->|页面正常/接口无报错| F[直接提交合并] E -->|异常| B

操作简单、节奏飞快,短期效率肉眼可见地暴涨。

但快归快,整套流程却缺失了开发最关键的一环:校验与思考

没人去核对逻辑完整性,没人补全边界判断,没人对齐项目编码规范,更没人排查潜在的性能与异常风险。

我最初接触这类工具时,也被这种 “高效率” 迷惑过。不用再手写重复代码、不用反复抠语法,一度沉浸在 “解放双手” 效率爆增的爽感中,甚至在想:未来编程这件事,是不是真的可以完全交给 AI?

但随着用AI开发的项目越来越多,做的事越来越复杂时,反而慢慢的回归理性。

在我看来,Vibe Coding 从来不是 “动动嘴就万事大吉”,它最核心、也最容易被大家忽略的本质,依托 AI 是为了提升编码效率,简化机械的基础编码工作,但还是需要依靠人自身的经验和专业技能才能真正地把控好整体开发质量,而非彻底放弃对代码的学习和掌控

当然这件事,也要分人群来看:零基础、非技术出身的朋友,用 Vibe Coding 确实能跨过编码门槛,不用系统学习编程,也能借助 AI 实现想要的功能,这是工具带来的便利。

但对于技术人来说,千万不能抱有 “有了 AI 就不用学代码” 的想法。AI 可以帮你敲代码,却没法帮你做判断。作为从业者,你必须能读懂代码,能分辨出哪些写法稳妥,哪些逻辑有缺陷。这是人的立身之本。

AI时代,人要做的是驾驭 AI,而不是被 AI 牵着走,人是AI的主人,而不是成为AI的奴隶。

2、AI 只在帮你干活,但并不为正确负责

首先要纠正一个误区:AI 不存在绝对的 “代码正确率”,它有的只是贴合提示词和上下文的拟合率

你可以把它理解成一个强大的文本生成器,它不会真正理解需求背后的业务逻辑。

它写代码的逻辑很简单:根据你给的上下文、指令描述,再依托海量训练数据,拼凑出一段语法规整、看起来合理、最贴近 “标准答案” 的代码。它擅长模仿,却做不到真正的思考

也正因如此,它根本不懂你的业务,不知道项目的隐性规则,更不会预判线上的边界场景。

我自己就踩过一个印象很深的坑。之前用 Claude Code 编写订单金额计算逻辑,代码本地运行一切正常,基础的单元测试也全部通过,当时便放松了警惕。

可代码上线后,出现了一个极小概率负数金额的异常情况。事后逐一排查才发现,AI 自动忽略了三类关键场景:入参空值判断、多轮折扣叠加导致的数值溢出,以及浮点运算四舍五入的精度问题。整段代码语法挑不出半点毛病,可核心逻辑却是残缺的。

还有更离谱的AI幻觉:它会编造项目里根本不存在的工具类、废弃的API、错误的数据库字段映射,代码看着工整优雅,实则完全无法落地。

AI编程的本质从来不是「AI替代人写正确代码」,而是人制定规则、把控逻辑、兜底校验,AI承担重复、繁琐、机械的编码工作

所以,永远不要盲目信任 AI 的输出,真正能守住代码质量的,只有我们自己经过校验过的工程体系。

在我看来,Claude Code 这些AI Agent 工具从来不是用来直接产出标准答案的 “代码神器”,它更像一位手脚麻利、执行力拉满,却时常粗心大意的实习生。改需求随叫随到,敲代码速度远超常人,但细节之处总容易出纰漏。

试问在职场里,哪位管理者敢把实习生写的代码,不经审核、不经测试就直接推上线?同理,使用 AI 编程,这份把关的责任,终究要落在开发者自己身上。

3、如何保证AI写出来的代码是对的,几点建议

第一步:定规则约束,从源头降低出错概率

很多AI代码出错,根本不是模型不行,是人给的指令太笼统

刚接触 AI 编程的朋友,往往只会简单交代需求:帮我写一个订单计算的方法。

而熟悉项目、懂得提要求的老司机,会把所有限制条件、业务规则一一说明:帮我写一个订单金额计算方法,要求使用 BigDecimal 计算、保留两位小数;入参存在空值情况,务必做好空值校验;代码要兼容折扣叠加、满减抵扣场景,绝对不能出现负数金额;同时复用项目现有的 utils 工具类,保持和团队一致的编码风格。

当约束越具体、规则越清晰、场景越全面,AI 发挥空间就越小,出错概率也会越低

除此之外,每次让 AI 编码之前,都要做好项目相关上下文同步:项目内已有的工具类、数据表字段定义、全局统一返回格式等。

提前把规则和边界划定清楚,不让 AI 随意发挥,这是把控代码质量最前置、也最有效的一步。

第二步:挑一个性能好一些的模型

AI 编码的质量好坏,除了第一步要建立好规则、约束、把需求说清楚外,模型本身的能力也非常重要。因此有条件的情况下,尽量挑一个性能好一些的大模型。

很多人用 AI 写代码翻车,不是自己提示词写得差,而是直接用了能力偏弱的模型。弱模型哪怕你需求写得再细、约束给得再全,它理解不到复杂业务、梳理不清多层逻辑、记不住上下文细节,最后依然写出残缺、漏判、甚至自相矛盾的代码。

我个人长期使用 Claude Code 的真实感受是:规则决定下限,模型决定上限。

所以:能用好模型,尽量用好模型。

但从成本的角度考虑,也要视任务来定,比如日常普通开发,用国产大模型比如GLM-5.2 或 DeepSeek V4 这些基本就能轻松搞定了;但对于一些核心业务、复杂模块逻辑,我一般会切换更强的模型来生成(比如Claude Opus 4.7)。

第三步:让AI帮你搞定80%工作,剩下20%人来盯

以前写代码,80%时间敲键盘,20%时间思考逻辑;

现在用AI写代码,我20%时间校对优化,80%时间专注业务、架构、边界、性能、安全。

这才是AI编程的正确打开方式。

这是整个流程里非常关键的一步,也是拉开普通使用者和专业开发者差距的地方。

很多人存在误区,觉得代码能编译、本地能跑通,就万事大吉了。可现实是:语法正确,仅仅是最基础的要求。

一段能上线的代码,不仅要逻辑通顺,还要全面覆盖边界场景,同时兼顾性能与安全。

我不会逐行看工具方法、循环遍历这类基础代码,但核心业务逻辑、数据流转、判断分支、异常捕获,会进行审核确认。

对此我的建议和自己做法是:AI写完代码和测试用例,自测通过后,我还会让AI初审一轮,解决七七八八后,最后再由人工审核确认核心逻辑。

第四步:沙箱 / 测试环境验证,模拟真实运行

经过前面三轮校验,代码已经相对稳妥,但最后还需要落地实测,避免纸上谈兵。

所有 AI 生成的代码,建议先部署到测试环境、沙箱环境中运行验证:

  • 接口代码用 Postman、Apifox 模拟真实请求,核对参数与返回格式
  • 查看完整 SQL 执行语句,借助 EXPLAIN 分析执行计划,规避语法错误和慢查询
  • 针对复杂逻辑,模拟线上高并发、大数据量场景做压力测试

走完这四步,Claude Code写的代码,正确率、稳定性就能远超大多数人工随手写的代码。

4、AI时代,最大的误区:把工具当能力

回到上面知乎问题,其实面试官想要的答案,从来不是一套校验代码的技术流程。

他想考察的,是你的职业认知

现在很多程序员的焦虑,完全源于认知错位:

误以为会用AI写代码,就是能力提升;误以为AI能搞定一切,自己就可以放弃思考。

真正的现状是:AI干掉的是“只会搬砖的程序员”,成就的是“懂逻辑、懂业务、懂兜底的程序员”。

Vibe Coding的快乐是真的,高效是真的,但隐患也是真的。

靠感觉编程,短期爽感拉满,长期只会废掉自己的逻辑思维和工程严谨性。一旦遇到复杂业务、线上故障、疑难问题,只会束手无策。

我很认同一句话:AI可以替你写代码,但永远不能替你承担线上故障。

代码出错可以改,思维惰性一旦养成,很难补救。

最后,送给所有在用AI编程的同学

我用Vibe Coding这两年多的最大感悟:

AI降低的是“写代码的体力成本”,提升的是“编码效率”,但丝毫没有降低“工程师的思考成本和责任成本”。

面试官问出这个问题,本质是想筛选出:你到底是工具的使用者,还是工具的奴隶。

只会复制粘贴AI代码的人,迟早会被淘汰;

懂得驾驭AI、校验AI、修正AI,让工具为自己所用的人,会在AI时代越走越远。

不用纠结AI写得对不对,记住一句话:

AI负责输出代码,工程师负责保证正确。