惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

云风的 BLOG
云风的 BLOG
阮一峰的网络日志
阮一峰的网络日志
有赞技术团队
有赞技术团队
小众软件
小众软件
P
Proofpoint News Feed
P
Proofpoint News Feed
Apple Machine Learning Research
Apple Machine Learning Research
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
The Last Watchdog
The Last Watchdog
O
OpenAI News
Security Latest
Security Latest
博客园 - Franky
Forbes - Security
Forbes - Security
N
Netflix TechBlog - Medium
H
Hacker News: Front Page
Cloudbric
Cloudbric
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Hugging Face - Blog
Hugging Face - Blog
Microsoft Security Blog
Microsoft Security Blog
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
S
Security Affairs
Recent Announcements
Recent Announcements
The GitHub Blog
The GitHub Blog
S
Schneier on Security
MongoDB | Blog
MongoDB | Blog
WordPress大学
WordPress大学
Last Week in AI
Last Week in AI
博客园 - 【当耐特】
Attack and Defense Labs
Attack and Defense Labs
C
Cyber Attacks, Cyber Crime and Cyber Security
F
Fortinet All Blogs
Webroot Blog
Webroot Blog
S
Secure Thoughts
Spread Privacy
Spread Privacy
Blog — PlanetScale
Blog — PlanetScale
T
Troy Hunt's Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
V
V2EX
Security Archives - TechRepublic
Security Archives - TechRepublic
P
Privacy & Cybersecurity Law Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Simon Willison's Weblog
Simon Willison's Weblog
C
Check Point Blog
L
LINUX DO - 最新话题
NISL@THU
NISL@THU
博客园_首页
罗磊的独立博客
A
Arctic Wolf
U
Unit 42

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理, 企事业单位数字化的业务供需本质 – 人人都是产品经理, 医疗智能体·第1讲——医疗信息化重构:从“辅助软件”到“自主智能体”的范式转移 – 人人都是产品经理, 粉丝量就是空气!!! – 人人都是产品经理, 用户说“薯片碎了”,机器回“要买吗?”:意图识别的翻车与破局 – 人人都是产品经理, RAG召回准确率从75到90 我做对了这三件事 – 人人都是产品经理, AI大事件:Anthropic改收费、OpenAI发安全版、手术机器人纳入医保、阿里发布”秒悟” – 人人都是产品经理, Chrome 推出 Skills 新功能,Agent 重塑上网方式 – 人人都是产品经理, GitHub前创始人拿了a16z的1700万美元,做Agent时代的Git – 人人都是产品经理 拷贝或克隆其他 Flutter OH 项目到本地后无法运行 – 人人都是产品经理, 优惠券设计:优惠券创建 – 人人都是产品经理, 不用死磕文档!AI 助手 1 小时搞定飞书 CLI 安装 + 配置 + 知识库 – 人人都是产品经理, 用小龙虾做竞品分析报告:从2天到20分钟,我是怎么做到的 – 人人都是产品经理 用小龙虾做市场分析报告:搞懂这3个公式,市场规模不再靠猜 – 人人都是产品经理, 你早就在做 Harness 工程,只是不知道它叫这个名字 – 人人都是产品经理, Think Long就够?你可能想多了! – 人人都是产品经理, 货代SRM实战:供应商准入怎么做,才能让资源池不是通讯录而是可交付网络? – 人人都是产品经理, 如何做好用户调研?详解基本技巧 – 人人都是产品经理, 木鸟、途家、美团对打,平台春天行动开“卷” – 人人都是产品经理, 入职才发现公司不靠谱?小红书从业者求职避坑指南 – 人人都是产品经理, 美国 AI 三巨头联手封堵,中国 AI 突围之路在何方 – 人人都是产品经理, 小红书,放在需求对面的镜子 – 人人都是产品经理, AI 会带来大规模失业吗? – 人人都是产品经理, 从出单到补货前,我第一次犹豫:该不该放大? – 人人都是产品经理, Flutter 三方库鸿蒙化适配:5 种高效检查方式,快速判断是否需要适配 – 人人都是产品经理, 从做产品进阶拿结果:医美机构产品经理转岗科室运营经理 – 人人都是产品经理, 阿里HappyHorse,一场关于“Token经济”的阳谋 – 人人都是产品经理, To B AI:客户留存落地的观察与思考 – 人人都是产品经理, AI产品的“生命线”——数据采集、标注、清洗的产品化设计 – 人人都是产品经理, 谈谈AI Agent(二):当“孩子”能自己“体验世界”时,你该学什么? – 人人都是产品经理, UI/UX设计师的3层能力进阶,前两层让你活下来,第三层…才是真正的分水岭 – 人人都是产品经理, 2分钟 → 30秒,效率提升75%:B端产品经理如何用「规则枷锁」驯服AI幻觉? – 人人都是产品经理, 还没来得及学OpenClaw,来了个更猛的:Hermes Agent – 人人都是产品经理, AI日报:宇树机器人跑出10m/s刷新世界纪录 – 人人都是产品经理, 一文说透基金互金如何用情绪价值引导用户决策做转化 – 人人都是产品经理, 当浏览器开始替你”看”网页:AI 浏览器正在亲手拆掉它脚下的那张网 – 人人都是产品经理, 0代码,一天时间我Vibe Coding了个网站 – 人人都是产品经理, Hermes 和 OpenClaw 之争,Agent 的能力应该“装上去”还是“长出来”? – 人人都是产品经理 视频生成的“桌子”,字节Seedance 2掀完,阿里快乐马掀 – 人人都是产品经理, 从听不懂到完全信任:我的 Codex 深度产品体验 – 人人都是产品经理, 当虚拟偶像有了北京户口,与真人偶像还有什么区别? – 人人都是产品经理, 会说,远远比会做更重要 —— 对 SBTI 爆火现象的五层观察 – 人人都是产品经理, AI产品经理必看:当“搭环境”比“选模型”更重要,你的认知还在2024年吗? – 人人都是产品经理, 2026年AI产品商业化核心逻辑:从功能demo到规模化营收的3个必破卡点 – 人人都是产品经理, 京东围绕供应链,卷起裤腿下场的那些事儿 – 人人都是产品经理, SBTI一夜刷屏:它赢在了“太会说人话” – 人人都是产品经理, 折扣零售的真相:不是便宜,而是价值感! – 人人都是产品经理, 和甲方吵了一架,最后加钱做了——我学到的ToB产品经理生存法则 – 人人都是产品经理, 和几位小红书操盘手聊了8小时,干货全在这 – 人人都是产品经理, 智谱GLM-5.1登场,开源模型首超Opus4.6!!! – 人人都是产品经理 Anthropic收入凭什么反超OpenAI,终于有人把这事说清楚了 – 人人都是产品经理, 史上最有故事感的技术报告——Claude最强模型Mythos 7个极其精彩的细节 – 人人都是产品经理, 模型不是壁垒,Harness 也不是 – 人人都是产品经理, 抖音本地生活业务思考21 – 人人都是产品经理, Superpowers:145k Star的AI编码框架,到底是什么来头? Superpowers:145k Star的AI编码框架,到底是什么来头? – 人人都是产品经理, OpenAI 的路走错了,Anthropic Harness 解法启示:模型需要实践专科生 – 人人都是产品经理, 画原型图的前一步:设计站点地图 – 人人都是产品经理, 给 DeepSeek 的最后一封催更信 – 人人都是产品经理, 手把手教你用 Claude Code 搭建 AI 营销团队:5 个 Agent、12 项技能,独立完成研究、写作、设计全流程 – 人人都是产品经理, 你以为大模型在学语言?不,它在重新发明语言学 – 人人都是产品经理 所谓Skill,不过是AI时代的工业垃圾 – 人人都是产品经理, 聊一聊内容传播的几个方法 – 人人都是产品经理, 当平台开始吃掉生态:从 OpenClaw 被封杀,读懂 Anthropic 的这盘棋 – 人人都是产品经理, 你装了 10 个 AI 插件,Obsidian 还是一个文件夹 – 人人都是产品经理 关于AI智能体架构演进的系统性思考:从单体试水到多体协同的重构 – 人人都是产品经理, 当“人”变成Skill,我们又该何去何从? – 人人都是产品经理 Mythos 事件:前沿 AI 治理的意外实验 – 人人都是产品经理, 货代CRM:信用与风险管理怎么做,才能把坏账风险拦在放货之前? – 人人都是产品经理, 从HR收集自拍照到员工自助录入——我见证了园区人脸识别从”不可用”到”真好用”的全过程 – 人人都是产品经理 千问闯关AI混沌期:阿里画靶,吴嘉张弓,马云射箭? – 人人都是产品经理,
2025生成式AI平台交互体验观察(大语言模型篇)
为美好而设计 · 2025-01-02 · via 人人都是产品经理

过去一年,大模型产品百花齐放,都开始卷价格和应用,对用户来说当然是好事。但就实际上手来说,这些产品的表现怎么样?这篇文章,我们来看看作者的分析。

The world is changing,it’s time we change too.

2024年是AI应用元年,从2023年ChatGpt爆火到国内百模大战,到现在AI技术应用在C端、B端百花齐放,新一代互联网商业模式MaaS(Model as a Service模型即服务)应运而生。

尽管AI应用很新潮,过去我们积累的用户体验设计经验也未必不管用。过去一年,我们看到了很多基于大语言模型的产品百花齐放,我想聊聊我的观察。

一、找到切入点

AI产品很多,功能很复杂,我们需要找到一个切入点,我想从黑箱理论说起。

苹果公司的黑箱理论:用户不需要了解系统或功能背后的实现逻辑,只需要关注呈现在用户眼前的交互界面即可。

很有意思的是,大语言模型从技术上来说本身就存在黑盒特性,这些模型的内部工作机制常常对我们而言就是一个“黑盒”。虽然这些模型的代码、参数和训练方法是公开透明的,但我们仍然难以追踪和理解它们如何从特定的输入生成特定的输出。

这种复杂性源自于模型内部多层次的非线性数据处理和海量参数的复杂交互,使得追溯和理解其决策路径成为一项巨大挑战。

就像人类决策是由复杂的情感、多重动机和丰富的个人经验交织而成的。AI模型同样如此,尽管我们了解它们的基础架构(类似于人类的基因)和训练过程(类似于人类的教育和经历),但模型如何综合这些因素以做出特定响应仍是复杂且难以预测的。

基于此,从黑盒理论和用户的角度出发,大语言平台本质上可以看成三个模块,输入模块-分析模块-输出模块,由此我们就有了相对直观的观察角度。

二、输入模块

输入通俗地讲叫向大语言模型提出“问题”,比较专业的说法叫“提示”或“指令”,也有一个专门的工程类别叫“提示工程”;是将信息输入到大模型中的必要前提。

很多时候一个好提示将决定结果的输出质量,并且一个问题经常是需要多次迭代才能生成最终的结果,用户的真实想法往往和实际意图之间差了好远。

吴恩达在《给每个人的大语言模型课》中说:“我不认为有一个适合每个人的完美提示,用户选择输入有一个从“想法”到“提示工程”到“模型回复”的过程,更有用的是有一个流程,当我自己在使用大模型时,经常会尝试和迭代,比如如果我不喜欢结果,我可能会澄清,如果仍没有给我想要的确切结果,我可能会进一步进行澄清和迭代。”

在输入模块,提升用户体验的核心点就在于如何更高效地帮助用户从一个想法,不断优化提示,使其更快速地接近所需答案的过程。

国内外生成式AI技术平台为此做了很多的努力。输入本身是有成本的,我根据用户痛点,对大语言模型平台的核心功能点进行了梳理。

降低输入成本

OK,小朋友们,让我们回到小时候的语文课堂,当我们在描述一件事情的时候,通常会遵循5W1H原则,即什么人在什么时间点在哪里做了什么事情,是如何做的,为什么做。

同样的,在向大语言模型输入提示的时候,我们依然可以遵循这样的原则。


但往往,可能是因为在真实的社交场景中,人与人在互相交流前就已经事先共享了一部分信息,在描述事情的时候也不需要那么全面。

大语言模型尽管由海量的数据训练出来,但面对单个用户时,双方其实并没有事先共享信息。所以帮助用户降低输入成本就比较重要。下面是部分解决办法:

主动理解意图

当面对交谈的对象语无伦次,东一榔头西一棒槌地描述的时候,我们会反问:“你想说的是不是这个…意思?”。

在输入模块,平台帮助用户做的也是这么一件事情:你想表达的东西,我帮你表达一部分,你看看是不是这个意思。下面我会举例:

ChatGpt的对话框下提供了多个用户常见的场景,创建图片|给我惊喜|总结文本|分析输入|分析图片|帮我写等。点击之后推荐对应场景的联想问题来帮助完善提问。

用户选择代替用户输入

豆包和文心一言甚至更贴心地把常用技能模块细分到更加具体的使用场景,进一步明确用户的目标,事先提供对应场景的功能,并且提供对话模版,用户只需要在对应窗格中填充文字即可。

Copliot在界面上提供各式各样的主题卡片,教育用户如何提问。

Kimi在输入关键词时向用户推荐更加全面的相关的提示词参考,提前理解用户意图。并且在后续的生成结果中,继续提供用户可能会提问的问题来引导用户。

增加输入参考

当有些信息无法用简短的语言描述时,比如图片、文档、网页,最简单直接的办法就是直接上传上去,作为输入的附加参考。

用户只需说:“参考这个内容帮我做XXXX事情”,这些附件内容会和文本信息会一起送进大模型黑盒里去。如今上传文件,上传图片,联网搜索,语音输入已经成为了生成式AI平台的标配功能。

自定义智能体

除此之外,尽管大模型很通用,在对话时,对于特定领域的业务,还是需要针对不同的属性进行定制化,让大语言模型先有一个明确的自我定位;比如是一个数据分析专家,或是健身教练,也可能是多角色的集合体AIAGent。

ChatGpt的探索模块支持使用并创建自己的智能体,针对特定的使用场景:提高效率|体验交流|价值创造提供多种多样的自定义版本的智能体。

Kimi+针对办公提效|辅助写作|社交娱乐|生活实用的特定场景提供各种各样的智能体。同样类似的还有文心一言、360AI、通义千问等。

而豆包比较有趣,在网页端,还比较正经,推荐了一些跟提效创作有关的智能体。

而到了手机端,豆包自己本身变成了一个几乎和其他智能体权重平等的应用,发现页中推荐了各种各样的情绪体验型智能体,主打和各种各样的明星和数字人聊天、打电话、谈恋爱、玩游戏,获得陪伴体验。

在集体AI平台都在卷AI硬知识技能时,豆包选择了将AI和娱乐挂钩起来,让AI产品变得有趣,在年轻人的荷尔蒙中发酵,这是互联网流量思维的玩法。

三、分析模块

在分析模块,当前主流大模型尽管在语言理解和文本生成上表现优异,但仍然在一些方面体验不佳:大模型回复等待时间长;不允许打断、插话;存在幻觉等。我将从这三点聊聊体验设计在其中的应用。

减少等待焦虑

在过去的加载页面等待研究中,我们有这样的共识:用户等待页面加成功时的耐心程度一般在2-3秒范围内,GooGle研究显示,大约53%的移动设备用户会在加载超过3秒时离开,每增加1秒延迟,用户转化率可能下降7%或更多,过长的等待时间会让用户感到不耐烦。

耐心时间范围

  • 0-2秒:最佳用户体验,加载速度快的页面会显著提升用户满意度。
  • 3-5秒:用户的注意力开始下降。如果加载时间超过这一范围,可能会导致用户放弃。
  • 6秒以上:用户放弃的可能性显著增加。研究显示,大约53%的移动设备用户会在页面加载超过3秒时离开。

因此,过去如果系统加载慢,用户体验师会设计加载动画或进度条,优先加载关键内容等方式来延长用户耐心,生成式AI平台也通过类似的方法来提升用户体验。

ChatGPT通过逐步每次都将生成的部分内容展示出来,使用户可以边阅读部分边生成来延长用户的忍耐程度。如果你在python中调用过大模型的API的话,大模型只会在生成所有文本后返回结果。你会发现大模型在生成长文本的时间其实还蛮长的。

通义千问和秘塔搜索通过展示加载分段式进度条来告知用户任务完成程度,降低时间感知,避免不确定等待。进度条的存在也能显示系统正在正常工作,增强用户对平台的信任。

Gemin通过logo动画,更加自然的淡入淡出刷新文字的加载动画,来进一步体现所搭载的大语言模型性能

提供打断工具

不允许打断插话这一点当前业内普遍做法都是提供停止输出工具,功能大多也大同小异。

不过最新的ChatGpt提供的画布模式,支持了对分析结果的具体内容进行进一步地编辑,引导用户进一步细化结果。

强化安全意识

由于大模型的黑箱特性,尽管RAG等数据投喂技术在一定程度上减少了大模型的幻觉,但当前业界最好的大模型推理一致性在97%左右,幻觉度约3%,距离ToB/ToH领域的规模应用,如网络规划、仪表和电器精准控制尚有差距。故AI生成能力本身的可信任度依然是需要担忧的事情。为此,在用户体验层面,设计的核心点在于增加大模型生成结果的客观性。

降低信任预期

大模型需要告诉用户生成的内容仅具有参考性,也可能会犯错,通常会在界面对话框底部强调。

增加生成内容客观性

通过RAG、LanGChain等技术与搜索引擎结合,从多个来源提取关键信息,实时检索和验证,生成综合性的回答,减少“幻觉”现象,提升答案的准确性和可信度。

四、输出模块

在输出模块,我想聊聊大模型的记忆、反馈、多模态输出的体验设计。

记忆

如果用python调用过大模型的API的话,我们会意识到大模型本身是没有记忆的。但是在与用户的对话中,平台会将当前会话的上下文信息作为输入模型的一部分,利用注意力机制处理这些信息,从而生成与上下文相关的响应,使得模型能够在单词对话中保持对近期信息的记忆,从而提供连贯的回答。

然而,大模型的上下文窗口长度是有限的,通常在数千个标记(toKens)范围内。这意味着当对话长度超过上下文窗口的容量时,早期的信息可能会被遗忘或忽略。技术层面研究人员为此提出了多种方法来增强模型的记忆能力。比如循环记忆、引入外部存储机制等,但仍然存在一定的局限性。

于是我观察到了针对这一场景的体验设计:

ChatGpt提供了归档功能,通过归档功能,ChatGpt可以记住用户在之前对话中的偏好、习惯或重要信息(如兴趣爱好、工作方向),从而更接近用户的需求。

Kimi/通义千问/文心一言则通过设置常用语功能来应对可能出现短期记忆突然失效的情况。

反馈

说了这么多,生成式AI平台的核心竞争力说到底依然是大模型本身的推理能力,如今的大模型依然容易继承和放大训练数据中存在的偏差,AI大模型难以避免会写出看似合理但不正确或荒谬的答案。大模型开发过程中很重要的环节是数据标注,会耗费大量的人力物力,ChatGpt的问世离不开背后大量工程师对模型数据微调校正标注的努力。

同时,AI平台的模型能力的增强也需要用户的反馈,通过每天用户海量的生成结果,从反馈给平台以进一步优化模型推理能力。越强推理能力的大模型平台拥有越多的用户,越多的用户越增强大模型推理平台的能力。

而这个反馈入口就在输出结果的下方,用户可以点击喜欢/不喜欢进行问题反馈,几乎所有的AI平台都有这个看似不起眼,但非常重要的功能。

多模态输出

尽管可能我们认知里的大语言模型平台更多是专注于文本类型输出,我观察到国内外很多的大模型平台都在往多模态生态方向打造,大语言模型正在和文生图、数字人、机器人、文生视频、内容理解、文本处理、社区等功能融合。背后的逻辑比较复杂,我将在下一个模块再聊。

总结

AI的发展虽然很快,但也是经历了漫长的过程,再伟大的创新,也会基于人们过往经验的总结。技术再强大,也是服务于人的,AI应用的风在互联网上吹了一阵又一阵,但杀手级的AI应用到目前为止仍未出现;场景不够匹配,AI的局限性依然是挡在AI应用路上的大山。

作为一个从业4年的交互设计师,我的心情无比复杂,不知道多少人和我一样,眼看着所谓的大机遇就在眼前,但自己却无力乘风,内心无比焦虑。外面都在说AI将颠覆整个互联网,又说所有的互联网产品都可以用AI重做一遍,担心自己的饭碗不保,担心自己跟不上时代的浪潮。但要我说,人们在面对未知时总是会放大恐惧,这些都不必过分担心。

丘吉尔有一句话:如果你到了地狱,那就继续保持前行。

让我们继续前行吧,朋友!

本文由 @为美好而设计 原创发布于人人都是产品经理。未经作者许可,禁止转载

题图来自Unsplash,基于CC0协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务