惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

The GitHub Blog
The GitHub Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Microsoft Security Blog
Microsoft Security Blog
J
Java Code Geeks
S
SegmentFault 最新的问题
Apple Machine Learning Research
Apple Machine Learning Research
N
Netflix TechBlog - Medium
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页
宝玉的分享
宝玉的分享
Google DeepMind News
Google DeepMind News
B
Blog RSS Feed
Hugging Face - Blog
Hugging Face - Blog
量子位
Blog — PlanetScale
Blog — PlanetScale
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
阮一峰的网络日志
阮一峰的网络日志
D
Docker
罗磊的独立博客
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
云风的 BLOG
云风的 BLOG
IT之家
IT之家
MyScale Blog
MyScale Blog
Microsoft Azure Blog
Microsoft Azure Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
从沉思到执行,AutoGLM 到底能否成为产品调研的好助手?
卜一定 · 2025-04-11 · via 人人都是产品经理

在人工智能浪潮中,AutoGLM 作为一款备受瞩目的产品,声称能实现“一边想一边干”的强大功能。然而,它是否真的能成为产品调研的好助手?本文作者通过亲身实践,从多个维度对 AutoGLM 进行了深度测试与分析,供大家参考。

媒体宣传说智谱清言可以“一边想一边干”,于是我立刻申请内测,开始使用 AutoGLM,期盼它能自主运行,帮我订一杯奶茶。结果是它只是帮我打开了美团网站,输出了一堆没用的信息,奶茶依然留在了奶茶店,没有出现在我的桌面上。

我随后又尝试了官网宣传的“订酒店”功能,结果还是一长串搜索与分析,最终也没有真正帮我完成酒店预订。

最终,我放弃了它“干”的功能,转而测试它“想”的能力,尝试用它来做一些深度分析。

从官网的用例来看,目前 AutoGLM 的核心功能,个人认为还是集中在 Deep Research 层面。我下载了 mac 版本的桌面应用,同时也下载了 Chrome 的 AutoGLM 插件。从插件的信息来看,支持自动运行的网站包括知乎、微博、百度等十几个网站。正如官网所说,目前该产品功能仍处于实验阶段,期待后续能够真正实现“一句话订酒店”的愿景。

我测试了一个“节假日西安周边游”的出行规划。从它的思维链可以看出,它的 workflow 包括:常规搜索、AutoGLM 搜索、工具调用、内容思考、总结输出。首次在小红书上的搜索失败,随后改用搜索引擎进行全局搜索。通过 tool observation 获取信息,从知乎、小红书、抖音等社交媒体进行详细搜索。

在搜索过程中,它会自动启动 Chrome 浏览器,可以看到 AutoGLM 的操作过程,比如调整小红书搜索帖子的过滤器,从“综合”调整为“最热”。操作过程中,浏览器会出现蓝色光晕闪现,表示正在工作中。

大约 10 分钟后输出了一份行程规划。但结果价值不大。因为是节假日,必然会遇到交通拥堵等问题,本应提前规划自驾路线,而报告中并未提供相应的出行路线规划。

官网介绍视频讲解了 AutoGLM 的技术路径:从通用基座模型 GLM-4,到推理能力大幅提升的 GLM-Z1-Air,再到强化学习训练出“沉思”能力的 GLM-Z1-Rumination,最终融合为 AutoGLM 的执行力。于是我开始横向对比它的“沉思能力”。

这几天我在研究 AI 在电子阅读器中的应用情况,于是随手用 AI 来做一份产品市场分析,用类似 AutoGLM 的“沉思”功能来测试它的思考整合能力到底如何。

在 Mac 客户端中输入 Prompt:“分析目前电子阅读器 AI 应用的情况,从产品功能、定价策略、用户评价、更新日志、社交媒体监听(受欢迎程度、用户反馈以及互动情况)、App Store / Google Play Store 数据分析(下载量、评分、评论内容、更新频率)等方面进行调查,必须依据最新的数据进行分析;另外分析未来 AI 在电子阅读器领域的应用趋势。”

尽可能让 Prompt 思考得更全面,并横向对比其他 AI 模型的推理能力。

输入 Prompt 后,客户端开始工作,首先进行免责申明,提示目前仍处于实验阶段。随后进行常规搜索,第一步完成推理后,生成搜索关键词。接着提示我确认品牌,我补充输入:“以亚马逊等主流品牌为基础研究,地区以欧美为主,中国为辅进行分析。”AutoGLM 再次搜索关键词,并在推理与搜索过程中自动启动了 Chrome,让用户实时看到其搜索流程。说实话,第一次看到它自动弹出网页并演示自动搜索过程还挺新鲜,但如果一直这样操作,就会影响用户体验。在用户进行多任务工作时,突然开启大量网页,不仅无实际帮助,反而还需要用户手动关闭,增加负担。

报告输出后,内容依然逃不过“大而全、泛泛而谈”的通病,对我需要的信息阐述不够细致,倒是展示了一堆额外信息。尤其是在数据范围方面并未详尽说明,比如价格和 Google Play Store 的数据分析基本缺失,提示无法获取相关数据。我理解这可能是因为智谱的网络环境限制了访问 Google 网页。

对比 ChatGPT-4o 的 Deep Research,它给的数据相对更“详尽”,对数据的解读也较为到位。用户评论总结有据可依,关键结论都附有网页链接,节省了二次搜索验证的精力。

而 Gemini 的 Deep Research 表现介于两者之间,虽然提供了数据描述,但没有像 ChatGPT 那样结构化地以表格形式清晰呈现。不过也提供了基本的数据与分析。从这个角度来看,ChatGPT 在这一项指标上胜出。

再来看 Manus 的表现,它同样提供了数据,并以结构化的方式进行了总结分析。对于常规研究,这些信息基本够用。目前给出的分析细节与数据可信度略低于 ChatGPT。

AI 对现有数据的整合能力很强,但对未来的预测仍然是基于现有数据的衍生与推演,我们也做了一些测试。

关于未来电子阅读器 AI 的应用分析,ChatGPT 给出了几个方向:

1.阅读器从“被动呈现”转向“主动交互”。AI 可以成为阅读伙伴,与读者共同探讨阅读内容。这是一个有趣的方向,但我个人认为阅读更偏向沉浸式体验,频繁交互可能反而影响体验。

2.AI 覆盖整个阅读流程,从“读前-读中-读后”全流程满足用户细分需求。这对于产品设计初期是很好的创意来源。

3.更自然的语音交互。这项发展已经非常接近现实,可能会对有声读物市场产生一定冲击。

4.推动端侧模型和云端模型的结合。类似手机产品,会有越来越多的 AI 功能通过端侧模型处理,进而推动硬件处理器发展。

此外,还有一些总结性的风险提示。

AutoGLM 的“沉思”功能提供的方向相对概括:

1.个性化体验

2.深度理解

3.多模态交互

4.跨设备同步

5.社交阅读

但整体分析偏简单,缺乏足够细节来“令人信服”。感觉像是“为了 AI 而 AI”。这些总结点目前主流阅读器已有实现,没有提出令人眼前一亮的新点子,显得平庸。对产品设计前期的头脑风暴也没能提供有力支持。

再来看 Gemini 提出的方向:

1.更智能的内容推荐

2.更自然的交互方式

3.增强的语言学习功能

4.AI 驱动的文本分析与理解

5.更强大的辅助功能

6.更互动的动态电子书

看完 Gemini 的分析,以及虽然没有展示但已测试的 Manus,可以看出各家对未来的预测已趋同,本质上并无太大差异。这说明,AI 能提供全面概括,但真正挖掘新的 AI 需求,仍需“以人为本”的体感洞察。

我们再来看下 Manus 的表现,它同样给出了数据,并且以结构化的进行了总结分析,对于常规性的研究,这些信息基本够用,目前给出的分析细节及数据可信度略低于 ChatGPT 。

综合来看,AutoGLM、ChatGPT、Manus、Gemini 对产品调研确实有积极作用。在传统桌面调研路径中,AI 节省了大量时间和精力,能够轻松获取基础产品信息。同时,AI 的智能性也可扮演产品助理角色,补充我们的思路。但在涉及定性层面研究时,仍需要“人肉”调研,真实使用产品、观察用户、聆听用户声音,才能深入挖掘产品需求。

我认为 AutoGLM 的优势,最终还是应聚焦在能够 执行用户操作 的任务上,比如电子购物、智能填表等。如果它能在执行力方面做出差异化,才能在众多思维链 AI 产品中脱颖而出。

本文由 @Antonio 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自 Unsplash,基于CC0协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务