惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Stack Overflow Blog
Stack Overflow Blog
D
Darknet – Hacking Tools, Hacker News & Cyber Security
爱范儿
爱范儿
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
有赞技术团队
有赞技术团队
罗磊的独立博客
博客园 - 三生石上(FineUI控件)
小众软件
小众软件
L
LINUX DO - 最新话题
T
Troy Hunt's Blog
博客园_首页
量子位
Jina AI
Jina AI
S
SegmentFault 最新的问题
IT之家
IT之家
Hacker News - Newest:
Hacker News - Newest: "LLM"
大猫的无限游戏
大猫的无限游戏
N
News | PayPal Newsroom
P
Proofpoint News Feed
Cyberwarzone
Cyberwarzone
S
Securelist
Google Online Security Blog
Google Online Security Blog
P
Privacy International News Feed
博客园 - Franky
美团技术团队
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
NISL@THU
NISL@THU
C
Cisco Blogs
V
Vulnerabilities – Threatpost
腾讯CDC
The Hacker News
The Hacker News
K
Kaspersky official blog
C
Cyber Attacks, Cyber Crime and Cyber Security
雷峰网
雷峰网
CTFtime.org: upcoming CTF events
CTFtime.org: upcoming CTF events
Security Archives - TechRepublic
Security Archives - TechRepublic
A
About on SuperTechFans
Webroot Blog
Webroot Blog
The Register - Security
The Register - Security
Scott Helme
Scott Helme
B
Blog
Security Latest
Security Latest
Last Week in AI
Last Week in AI
Google DeepMind News
Google DeepMind News
W
WeLiveSecurity
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
T
Tenable Blog
Blog — PlanetScale
Blog — PlanetScale
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
S
Schneier on Security

博客园 - 狂师

从 LLM 评测到 AI Agent 评测,我的一些思考! 测试开发必备的 AI 技能库:推荐6 个让接口自动化测试效率翻倍的 Skills 推荐一款开源工具:让 AI Agent 替你做 iOS、Android 自动化测试,能平替 Appium? AI 测试必备:多Agent Skill 智能编排,从「脚本执行」到「失败自愈」到「报告生成」,一键跑通全流程! 10万人都在用的 top10 skills,我帮你试了! 还在手写测试报告?推荐一款 AI 测试Skill:只需一句指令,自动生成专业定制化测试报告! 测试人员必备:推荐一款智能测试数据清理AI Skill,支持db、redis、mq等 AI 测试必备:推荐一款能让自动化失败脚本「自己修好」的 AI skill! 端开发必装 Skill 清单:6 款 AI 技能,让你的开发效率原地起飞 AI 测试提效神器:推荐一款接口自动化测试提效skill! 做一款企业真正敢用的 AI 测试应用,到底难在哪? 新手学 Skills:是什么、怎么找、如何开发?(最通俗易懂版) 2026 最新 AI 学习路线全景图:从零基础到 AI 全栈测试与开发实战(附一站式智能测试平台) 2026 最具幸福感的互联网大厂排名! 聊一聊近年来互联网公司的裁员情况 比 Playwright 更给力,推荐一个AI Agent的浏览器自动化开源项目! 测试工程师的AI 技能库:推荐5个让你效率翻倍的Skills AI测试必学 | AI 赋能接口自动化测试系列(四):接口自动化脚本质量检查与优化Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(三):接口自动化测试脚本生成Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(二):全场景测试数据智能构造Agent Skill AI测试必学 | AI 赋能接口自动化测试系列(一):接口文档智能解析Agent Skill推荐 测试必学:推荐4个测试用例设计最值得掌握的Agent Skill,几乎覆盖所有用例设计场景! 面试官问:你用 AI 编程半年了,那怎么保证 Claude Code 写出来的代码是对的? AI 测试赋能全流程实战 | Agent Skill + AI 赋能「需求分析」 6000 字干货|Coze 智能体实战:搭建需求文档到测试用例自动生成工作流! QA Use:推荐一款AI 原生 E2E 测试平台,自然语言一键跑通用例! 2026学扣子Coze看这篇就够了!(新手入门教程) Codex新手保姆级教程:新手从安装到跑通第一个项目! 做一款企业真正敢用的AI测试应用,到底有多难?究竟难在哪? Claude Code 9 大神级 Skills,开发效率直接翻倍(安装、使用场景、踩坑经验) 别再瞎搞 AI 了!大厂AI业务落地的五个关键环节!(建议新手直接照搬) 有了AI测试工具,还需要掌握Playwright、Pytest、Selenium这些框架吗? 毫不夸张地说,这将是目前最全的AI测试教程!测试必看! 最近面完 30 个想转 AI 测试的人,我麻了:80% 都踩了这 4 个坑! 2026年我做了一个大胆的决定:我要收徒弟了! 程序员逼格拉满!ccstatusline:让你的 Claude Code 状态栏直接封神! AI 测试全场景提效:功能 / 性能 / 安全 / 自动化,用 AI 重塑测试工作流 2026 年 AI 编程实测:6 款顶流大模型对比,效率直接翻倍! 面试必问:公司用AI 赋能自动化,你是怎么用AI 做自动化测试的呢?(附落地全流程) 牛逼!119K star,软微开源神器,一款功能超强大的markdown 文档转换工具! 你说你会AI测试,那你是怎么实现AI+软件测试的呢?(附带5 层AI 质量管理体系) 一道面试题刷掉 90% 的人,测试人必懂:AI 生成用例的3 大陷阱 + 7 项审核指标 零代码 AI 自动化测试神器!Browser‑Use Web UI 保姆级教程,测试人直接上手 不用写脚本!Browser-Use 实操:AI 直接驱动浏览器自动化测试 推荐一个测试人必备的Skills,从功能到性能全搞定(附详细实操和安装下载方式) 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 CC‑Switch 原来是这么玩的!90% 的人都没用对 为什么你的OpenClaw做不好自动化测试? AI到底会不会导致大规模失业?一次性把所有问题讲透!(深度好文) 推荐3款必备“测试神器”Skill:用例生成、根因分析一键搞定 为什么现在所有大厂都在做 CLI ?(附Cluade Code接入飞书CLI教程) 自动生成用例:基于OCR+ LLM的设计方案(附落地指南) 太强了!GLM-5.1 第一手实测,平替Claude Opus 4.6? 测试人必备的4个AI Skills(附下载地址和详细用法) 我带学员用 AI 做了个热点监控工具,太好用了! 测试必学:UI 自动化最值得掌握的两个Skills,几乎能覆盖所有UI测试场景! Cursor 生成测试用例实战:一个 Skill,10 分钟产出可评审测试用例 90% 的人都用错了!Playwright vs Chrome DevTools MCP到底该怎么选? 全球首个龙虾模型:GLM-5-Turbo(手把手安装、配置、使用教程)来了! 测试开发效率翻10倍!这10款AI Skills神器,我敢说90%的人没用过 对标OpenClaw,腾讯版国产“小龙虾” WorkBuddy正式上线了! Claude Code+GLM 5 安装配置与10个快速上手技巧 OpenClaw新手必看!推荐10个神器技能包 新手保姆级教程:OpenClaw 自动化操作浏览器!
Agent 工具到底怎么选?
狂师 · 2026-07-17 · via 博客园 - 狂师

市面上这么多的 Agent 工具,到底应该选哪一个作为主力工具呢?

这个问题,是最近一段时间粉丝和学员最常问我的。也难怪大家困惑——从今年 3 月到现在,本地 Agent 逐渐走入大家视野。

市面上涌现了一大批优秀产品:国内的有 WorkBuddy、Trae Work、Kimi Work,海外的有最近很火的 Codex、Claude Code,还有 Manus。

我自己呢,Codex 和 Claude Code 两款都是主力。

下面分享一下,关于 Agent 工具选择,我自己的一些看法和经验。

先问自己:你愿不愿意折腾海外产品?

在选择 Agent 工具之前,你需要先问自己一个关键问题:你是否愿意折腾海外产品?

其中的细节这里就不再赘述,大家懂的都懂。

使用海外产品,对大部分国内用户来说还是有一些门槛的。这个门槛可能不是知识上的。

如果你有条件、愿意折腾海外产品,强烈推荐 Codex 或 Claude Code。

Claude Code 更适合技术人员。

非技术人员,首选 Codex——因为它的 GUI 界面更友好,上手门槛很低。

我们在使用工具的核心目的不是为了用工具,而是用最低的门槛使用这个工具解决我们核心的问题。因此上手的门槛越低,这个产品越好

不方便用海外产品?国内看这两款

如果你确实用海外产品不太方便——可能因为公司原因,也可能因为个人原因——那我推荐你关注国内两款产品:WorkBuddyTrae Work

分别出自腾讯和字节。

两款里面,我更推荐 WorkBuddy。为啥呢?

因为 WorkBuddy 的整个生态结合更丝滑。比如 Skill 生态,它接入得非常广,你可以很方便地给 Agent 加载各种 Skill。再比如连接器——你可以通过 WorkBuddy 连接钉钉、飞书、企业微信,甚至让腾讯会议帮你约会议,这块做得非常好。

Trae Work 呢,到目前为止我觉得还不够完善。

另外,你也可能需要根据使用成本来决定。拿相同的任务去测试两款产品,看看哪个消耗的积分更少,综合成本和便捷性来做最终决定。

Agent 是框架,框架会趋同——别纠结

Agent 其实是一种框架,而框架最终都会趋同。

什么意思呢?举个例子:

Codex 出现之前,Claude Code 是大家比较认可的本地 Agent,Skill 也是 Claude Code 最先接入的。但 Codex 作为后起之秀,很多功能借鉴了 Claude Code。

再比如国内的 WorkBuddy、Trae Work,很多功能设计也借鉴了 Codex 或 Claude Code。

为什么?因为优秀的设计心有灵犀,发现对方有好功能,大家都会借鉴。

所以在选择框架这件事上,除了前面讲的成本和易用性,我认为选一个用起来最顺手的,最重要。

不需要在意别人是否在用更先进的框架。只要你的 Agent 能丝滑地解决问题,你用起来顺畅,就坚持用。

框架定了,什么才是决定因素?——模型

既然 Agent 是框架,那什么才是框架最核心的决定因素?

我觉得是模型。

模型决定的是整个 Agent 的下限。用一个很差的模型,即使框架再好,也可能无法解决问题。

说到这,强调一点:很多朋友在用 Agent 产品时,模型选择默认是 Auto。Auto 的意思是系统根据当前资源帮你分配模型。

相信我,大部分情况下,自动分配的都不会是好模型。

所以对于重要、复杂的任务,建议你主动选择优秀的模型。

模型怎么选?

以 WorkBuddy 为例,能选的模型里,以下几个是我认为比较好的:

首推智谱的 GLM-5.2——从这个模型的使用成本和排序上也能看出来,质量非常不错。

除此之外,像 Kimi 的 K2.7DeepSeek V4 Pro,也都是海内外口碑很好的模型。

当然,如果你有条件用海外模型,比如 GPT 系列或 Claude 系列,肯定首推这些。

客观来讲,国内外的模型确实存在一定差距,用海外最顶尖的模型,体感上确实比国内好一些。

一个重要原则:原生配原生

最后强调一点:任何一款模型,最适配的 Agent 框架,一定是这家公司自己出的原生 Agent。

什么意思?

你用 Codex,那这个框架下最好的模型一定是 GPT 系列。你用 Claude Code,最适配的一定是 Claude 原生模型。

很好理解——模型和应用都是一家公司的,适配是天然发生的。

我之前看到有些朋友研究怎么在 Codex 里接入 DeepSeek 系列模型。当然,我很理解——一方面是成本考虑,一方面是便捷性考虑。

但还是建议:如果你都能折腾上 Codex 了,不妨找些渠道接入 GPT-5.5 模型,体感会提升非常多。

OK,以上是这期视频的全部内容。如果你觉得对你选择 Agent 工具有帮助,欢迎点赞、收藏、转发给周围的朋友。