惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
N
News | PayPal Newsroom
WordPress大学
WordPress大学
T
Tailwind CSS Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Last Week in AI
Last Week in AI
博客园 - Franky
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
H
Hacker News: Front Page
有赞技术团队
有赞技术团队
Scott Helme
Scott Helme
博客园_首页
Hugging Face - Blog
Hugging Face - Blog
博客园 - 司徒正美
V
Visual Studio Blog
S
Securelist
Jina AI
Jina AI
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
腾讯CDC
P
Palo Alto Networks Blog
K
Kaspersky official blog
IT之家
IT之家
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
大猫的无限游戏
大猫的无限游戏
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Security Latest
Security Latest
Webroot Blog
Webroot Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
V
Vulnerabilities – Threatpost
W
WeLiveSecurity
T
Threat Research - Cisco Blogs
博客园 - 【当耐特】
Cisco Talos Blog
Cisco Talos Blog
P
Proofpoint News Feed
Cyberwarzone
Cyberwarzone
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
月光博客
月光博客
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
酷 壳 – CoolShell
酷 壳 – CoolShell
Google DeepMind News
Google DeepMind News
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
L
LINUX DO - 最新话题
Latest news
Latest news
T
Tenable Blog
The Register - Security
The Register - Security
Recorded Future
Recorded Future
博客园 - 叶小钗
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
智谱 GLM-5:当 Agent 融入日常生活
一泽Eze · 2026-02-24 · via 人人都是产品经理

智谱发布开源模型GLM-5,专为复杂Agentic任务设计。从4分钟自主规划7人聚会路线并生成可视化地图,到自动聚合多信源生成资讯日报,GLM-5展示了强大的多步拆解与工具调用能力。当MCP连接现实服务、Skill定义场景流程,2026年每个人的'口袋Agent'时代或许已提前到来。

如果让你来协调六七个人的聚会选点,你会怎么做?

每个人从不同的地方出发,有人坐地铁、有人开车,你还得考虑通勤时间的公平性。不能让某个人跑一小时,其他人只走十分钟。

光在群里收集完所有人的出发地,打开地图一个个查,你大概就已经想说……算了,随便选个中间的点吧。

我把所有人的出发地发给了 Agent ⬇️

在无人干预的 4 分钟内,它自主调用 40 次地图工具,交错思考 25 轮后,一次性给出了综合各方通勤距离的选点方案,附带每个人的出行建议。

还做出了完整清晰、带有路线方案与用时的可视化路线图:

👉 完成这个任务的是 GLM-5。

智谱过年前最新发布的开源模型,专为多阶段、长步骤复杂 Agentic 任务设计。侧重拆解复杂任务、调用外部工具、多步自主执行。也是 Opus 4.6 等海外模型正在走的方向。

这篇文章,我会分享有关 GLM-5 的一切:

1.速览 GLM-5 规格参数、使用途径

2.Agent 效果实验与 Skill 方法:聚会选点、资讯日报自动生成……

3.我对 GLM-5 的使用感受,以及 2026 年 Agent 变化的小想法

抛开 Coding 视角,Agent 现在能帮我们什么,也在这个过程中感受 GLM-5 的新提升。

速览 GLM-5,你所需知道的一切

GLM-5 正式发布前,有个小插曲。

一个叫「Pony Alpha」的匿名模型,悄悄出现在 OpenRouter 上,占据模型趋势榜前列。

现在身份揭晓了,就是 GLM-5 的测试版。

GLM-5 已在 Z.ai、智谱清言、BigModel 上线,可以在上述网站直接使用。

得益于 Agent 能力提升,Z.ai 直接在官网推出了 Agent 模式,能够自行使用多种工具、技能,交付复杂任务结果,当前可免费体验。

另外,技术方面,GLM-5 新模型的变化相当明显:参数规模提升明显,GLM-5 总参数从 4.7 的 355B(激活 32B),拓展至 744B(激活 40B),预训练数据从 23T 提升至 28.5T,通过更大规模的预训练算力,提升模型通用智能水平采用全新的异步强化学习框架「Slime」,提升强化学习后训练流程效率并且采用了 DeepSeek Sparse Attention 机制,在维持长文本效果无损的同时,大幅降低模型部署成本

——说人话就是:多、快、好、省。(不客气,我是翻译侠)

在业内多个公认的主流基准测试中,Coding 和 Agent 跑分均到了开源模型前列。

在多个榜单表现中,基本对齐 Claude Opus 4.5

价格方面,输入 4-6 元/百万 tokens,输出 18-22 元/百万 tokens,是国产模型的主流定价区间。

依然全系开源,遵循 MIT 协议。

且已纳入 GLM Coding Plan 计划,兼容 Claude Code、Opencode 等主流 Agent 工具,也支持在 OpenClaw 中接入 GLM-5。是日常在 Agent 中爽用 GLM 模型的好选择。(Coding Plan 订阅地址:https://bigmodel.cn/glm-coding)

本次还发布了专门的 Z Code 工具,用户可以用手机远程指挥桌面端 Agent,解决代码、生活办公等复杂任务:

1️⃣ 日常生活中的复杂 Agent 任务:多人聚会路线规划

最近新模型们的 Coding 能力越来越强,讲真挺难想出好办法,让非技术的读者们能在短篇幅内,感受到模型的能力提升。

灵机一动,与其强行讲解重构、Debug 效果,让 Agent 融入日常,解决生活中的复杂任务,也是一种有意思的新测试角度。

相信大部分人都经历过聚会选点的难题:约了几个朋友周末聚聚,地址选在哪更为方便?

为了解决这个问题,我们不得不多次在地图 APP 内选点、规划路线、估算时间。人数越多、距离跨度越远,任务也越复杂。

不过,这刚好是个典型「拆解任务、调用工具、多步执行」的复杂任务,简直是用来测试模型 Agentic 能力再好不过的 Benchmark。

整个配置只要 1 个高德地图 MCP。

只要把每个人的出发地和交通偏好列出来,Agent 就能自动找出一个对所有人通勤最公平的聚会地点(最优策略 = 让路程最远的人耗时最短)。

1)路线规划:GLM-5 效果如何?

为了能有更好的测试效果,我设计了一个完整的 benchmark prompt ⬇️

也可以用于你的日常使用,对参与者信息稍作调整后,发给配好 MCP 的 GLM-5 Claude Code 就行。

prompt 示例

然后就不用自己操心了。

GLM-5 会自己拆任务,逐一将出发地解析为经纬坐标

搜索地理中心区域的候选聚会点

可以看到,在执行过程中,GLM-5 充分发挥了 Agentic 模型的自主性和复杂任务适应能力,多次、主动查询了大量不同点位、不同交通的各方耗时情况 ⬇️

并用一次性路径规划接口,交叉计算每个人到各候选点的通勤方案。

最终输出了各人出行方案,包含每个人从哪出发、走哪条线路、坐什么交通、预计多久到达。

总计整个过程仅需 4 分钟,无人干预,自主推进。

相较于人类用户自行翻查地图 APP,分次输入每个人的起点、目标点,Agent 能一次性查询目标地区的多家咖啡店,并考虑不同交通方案,大幅提升此类决策的效率与准确度,整个流程快了太多。

2)制作可视化路线图,验证可信度

为了能够更好的看看路线规划的效果,我继而要求 GLM-5 做了份可视化路线图:给我做一个浏览器能看的 HTML 地图,用地图可视化标点体现出来他们的起点和最终的终点以及大致的路线。用于让参会者一眼明白自己的路线建议方案。

它生成的第一份 Google Map 风格路线图是这样的:

非常清晰,标注了各方所在的起点和目的地,还有各自的出行方式、大致路线、时间的完整指引。

如果不是我说,你肯定想不到这是 Agent 生成的临时地图,在聚会时能省下太多决策与寻路精力。(甚至在高德 APP,我们没法做出同时查询多人路线)

刚才的地图偏向 Google Map 风格,我还试着让其一键编程为 Apple Map 风格,这是对应的结果 ⬇️

前端 Coding 审美过关,GLM-5 在 Coding 能力上也依然保持了一直以来的优秀水准。

最终,手动与高德地图 APP 的实际导航建议比对,验证方案真实性,基本出行方案与用时结论也都与 APP 近乎一致 ✅

路线规划是个典型的多轮工具调用的复杂 Agent 任务,甚至通过增加参会人数、距离跨度,能持续提升任务难度。

而测试下来,GLM-5 不负其榜单表现,Cover 了该任务所需的 AI 能力。

附:如何尝试多人聚会选点 Agent 任务?

整个任务只要配置一个 MCP:高德地图。

到高德开放平台申请一个 Key,把 MCP 配置到你的 Coding Agent 环境里(我是 Claude Code),就可以开始了。

大致流程如下:

1)安装 Claude Code:

如果你还没有 Claude Code,可参考我的历史文章 Agent Skills 终极指南 。你可在「第二部分:Skill 完全教程」中学会如何安装,顺便习得当下最值得学习的 Agent Skill 用法。

2)获取地图 MCP Key:

高德给了个人开发者每月 15w 次的地图服务额度。

参考 https://lbs.amap.com/api/mcp-server/create-project-and-key ,在 https://console.amap.com/dev/key/app 注册开发者身份并创建应用,即可获取高德 MCP Key。这是 GLM-5 Agent 查询地点、路线的关键工具。

3)让 Claude Code 替你配置地图 MCP

在 CC 对话界面中发送以下 Prompt:

添加 MCP:{
  “mcpServers”: {
    “amap-maps-streamableHTTP”: {
      “url”: “https://mcp.amap.com/mcp?key=【此处替换为你的 MCP Key】”
    }
  }
}

Agent 就会自动帮你完成 MCP 的剩余配置,完成后重启 CC。

接着只要按上文示例发送任务消息,AI 就能自行批量查询地点,规划出行路线。

接下来看另一个办公、生活常见的需求:多信源信息聚合。

2️⃣ 每日资讯日报:多信源信息聚合

日报生成是一个典型的 Agent 任务:多信源、多工具、流水线处理。

有朋友戏称其为:AI 时代的 Hello World(程序员梗:学编程的第一步就是让程序输出 Hello World)

我用 Claude Code 做了一个 AI 资讯日报的 Agent Skill:

和 AI 说明想关注的信源,Agent 就能自动抓取、筛选、摘要,生成一份结构化的每日资讯,并把每日的资讯自动部署为好看的网页。

这是它的整个Agent 设计流程介绍,全程尽可能依靠 Agent 自行处理爬取过程中不同信源的处理问题。

对于基座模型来说,想要一次性无错完成,也是不小的挑战。

在测试 GLM-5 的过程中,只需要我发送一条 Skill 调用指令:

GLM-5 就作为 Agent 的基座模型,一口气处理了最近 3 天的多个信源的资讯,涵盖 OpenAI、Anthropic 官网 News,X 上的特定关注者、以及部分海外科技资讯网站。

有意思的是 Agent 在这个任务里的工具调用方式。

不同类型的信源有不同的自适应获取策略:

  • Level 1:RSS 源直接解析 feed
  • Level 2:普通网页用 WebFetch 抓取
  • Level 3:需要登录或 JS 渲染的页面则调用 Browser MCP 操作浏览器,避开反爬机制。

更加智能的是,当你要求添加信源时,Agent 能根据需要,自行判断每个信源该用哪种方式,逐一执行,再统一去重、摘要、排版。

这类「重复、多步、有明确规则」的信息聚合任务,特别适合交给 Agent。人来做很累,每天打开十几个网站逐个翻阅;Agent 做就是一条指令的事。

最终,GLM-5 一次性完成了日报的信源抓取、入库、分条摘要、合并日报、网站更新的全过程。相当顺滑、实用。

这个 Skill 目前已经放在了 GitHub 上供体验:👉

你可以在「eze-skills」获取我全部公开的 Skill:https://github.com/eze-is/eze-skills

Daily-news 也还在迭代中(主要想优化多信源的并行抓取策略),主流程已经可用,感兴趣可以试试。

🎐 写在最后:当 Agent 融入日常生活

智谱在发布 GLM-5 时,给它定的主题是 Agentic Engineering 时代。

从实测体感来看,GLM-5 的 Agent 任务执行力确实到位。多步拆解、工具调用、自主推进,完成度又有了质的提升。

社区也生产了一批复杂 Coding 的 Case,你可以在这个视频里,看看 GLM-5 的其他 Coding 效果。

距离上午官宣发布到写文的这段时间内,由于大量用户的涌入,GLM-5 的 API 速率出现了短期波动,GLM Coding Plan 也已经在官网售罄。

只不过 GLM-5 是纯文本模型,多模态版本需要等待后续更新,“贴张参考图让 AI 照着做”这类视觉提示效果不会太好(官方采用 4.6v 联用的方法进行兼容),前端风格迁移设计场景受限。

但正如文章展示的,即使在生活类复杂任务中,不依赖视觉的 Agent 任务空间,也已经相当具备想象力 ⬇️

另外,你应该也发现了,这篇文章故意没聊 coding benchmark 测试。

因为时至今日,如果未经精心设计高难 Benchmark,你越来越难单凭简单 Case,体感区分国产和海外模型的能力上限。更多模型差异来自于提示习惯与模型自身思考风格的偏好。

然而,从 Claude Cowork、OpenClaw,再到国内的各类办公 Agent,

今年将有一个趋势值得关注:构成 Personal Agent 的关键拼图,已然初具雏形

GLM-5 等 Agentic 模型越来越强,国产模型已足以应对多阶段、长步骤的复杂任务MCP 连接现实服务,寻路、抓取、浏览网页、操作 office 文件,Agent 的”手”越伸越长Skill 定义场景化的处理流程,让 Agent 按 SOP 自主执行Memory 沉淀人与 Agent 之间的交互记忆,让 AI 越来越懂你的语境与偏好

2026,Agent 开始走出 IDE,作为每个人的口袋 Agent,处理人人都有的日常复杂需求。

每个人的 Personal Agent,可能比我们想的更快到来。

希望本文能对你有所启发,记得关注~

本文由人人都是产品经理作者【一泽Eze】,微信公众号:【一泽Eze】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。