惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

N
Netflix TechBlog - Medium
J
Java Code Geeks
爱范儿
爱范儿
雷峰网
雷峰网
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
博客园 - 三生石上(FineUI控件)
H
Hackread – Cybersecurity News, Data Breaches, AI and More
B
Blog RSS Feed
Google DeepMind News
Google DeepMind News
Jina AI
Jina AI
The GitHub Blog
The GitHub Blog
I
InfoQ
月光博客
月光博客
博客园 - 聂微东
博客园 - Franky
The Cloudflare Blog
阮一峰的网络日志
阮一峰的网络日志
博客园_首页
G
Google Developers Blog
Blog — PlanetScale
Blog — PlanetScale
L
LangChain Blog
罗磊的独立博客
Apple Machine Learning Research
Apple Machine Learning Research

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
怎么去做用户调研?-样本替换篇
场景阿侯 · 2022-05-28 · via 人人都是产品经理

编辑导语:用户调研对于互联网产品设计过程十分重要,本篇文章作者从样本替换的方面讲述了做用户调研的方法,以及网络访问固定样本的定义和构建过程等,感兴趣的小伙伴一起来学习一下吧,希望对你有帮助。

一、现象

用户调研是统计学上的问题,可理解成是抽样调查的一个分支,是在随机原则的保证下根据样本的情况来预测总体。

但因互联网产品迭代周期短,速度快,不少PM在进行用户调研时,遵循操作易,成本低,结论精等原则,大多数选择的方式为网络问卷调查或数据库采集进行分析,是一个非随机的过程

因此,应通过一定的举措减少非随机调研带来的干扰,使结论尽可能的准确,完善相应的调研体系。

网络调研的系列操作被执行时,经常会遇到以下三种情景。

  1. 对象A是目标调研个体,但根据现有的渠道,无法取得联系。
  2. 和对象A取得联系,并得到回复,但关键问题没有作答。
  3. 和对象A取得联系,关键问题有作答,但该作答不合理或前后矛盾。

把情景概括,即是用户调研中的无回答或数据缺失问题。

对此,产品人大多所选择的解决办法是,把无回答或数据缺失的样本直接剔除,不参与最终的预测。

这样所带来的问题有两个。一是,样本量降低,导致原本预测合理性已经不高的网络调查进一步降低说服力;二是调研的人力和时间成本已经产生,获取到的信息却不被使用,投入产出比低下。

此时,若能针对无回答或数据缺失的样本,在另一个群体中找到与其画像接近的个体,用该个体的回复进行替换预测,是一种值得学习的理论。

这种解决思路在抽样调查当中有专门的研究领域作为理论上的支撑——“基于样本匹配的样本选择在网络访问固定样本中的应用”。

二、网络访问固定样本

当目标调研群体A中的某些个体出现无回答或数据缺失现象时,从群体B中找到画像与其最为接近的单元,进行一一的配对,后用匹配对象的回答来替换原单元,实现更迭。

这样的过程即为样本替换,群体B则是网络访问固定样本。

1. 定义

互联网产品侧的网络访问固定样本应是这样的一群人:他们可以通过某种明确的渠道被触达,触达前群体中的每个个体具备可知的依赖标准,触达后愿意对特定问题进行反馈,是一个虚拟的群体。

1)渠道

指的是与群体进行沟通的方式,在互联网产品的网络调查中,可定义为官方联系。

如,官方邮件,官方小助手,客服电话,官方粉丝群等。

需要注意的是,官方联系强调对个体信息的获取,却不一定会被对象所感知

如,对于直播产品,产品侧可随时通过后台了解某用户当天给某主播的送礼金额是多少,无须和其进行实际上的沟通,此时,数据库也归属于官方联系的一种

2)标准

指的是个体所携带的信息,某指标变量,或自定义的计算规则。

互联网产品侧在进行用户调研时,用户通常和其账号绑定,对用户调研,即对某个账号的行为进行分析。而账号的行为又会根据产品的埋点体系,被进行对应指标的监控。

如,某社交产品,账号1在数据库中,其注册信息为男性;截至调研当天,粉丝数为10人,关注数为15人;经计算,过去一周,其浏览他人主页次数达50次。

此个体,在网络访问固定样本中所相近的,可能是账号2,注册信息为男性;截至调研当天,粉丝数为11人,关注数为17人;经计算,过去一周,其浏览他人主页次数达48次。

3)反馈

指的是对具体的用户调研活动进行参与,可以是主动地填写网络问卷,也可以是被动地从数据库提取分析

样本替换的核心是根据标准进行的匹配过程。若匹配过后的个体仍不具备有效作答的特征,仅需再次进行配对即可,直至有效且最佳的替换出现。

2. 构建

网络访问固定样本是一个虚拟集合存在,每一匹配标准可知的个体均是其中的一员。

根据构建固定样本的时间节点,可将构建操作分为存量型和临时型。

1)存量型构建

用户调研操作执行前,固定样本已经存在且被规模化的维护。

  • 外在表现形式通常为数据库当中的某张表格。
  • 存量构建所采用的匹配标准,是变动频率相对不高的指标,一般是怎么去做用户调研?-用户画像篇所提及的静态划分依据,同时和某调研主题相关,具有通用性。
  • 固定样本所依据的匹配准则信息需要定期更新。
  • 用户调研的相关操作被项目组认可,执行频率高。

2)临时型构建

用户调研操作执行时,根据匹配标准从数据库中进行临时计算,匹配标准可知的个体均成为固定样本中的一员。

  • 是一个有关用户账号的虚拟集合,每个账号所携带信息分布在不同的数据库表格中。
  • 临时构建所采用的匹配标准,是变动频率相对较高的指标,一般是怎么去做用户调研?-用户画像篇所提及的动态行为,是针对某次具体调研而制定的计算规则。
  • 固定样本所依据的匹配准则在某次具体调研时再确认,不涉及定期更新的问题。
  • 用户调研不作为项目组的高频工作内容,无须先行构建存量型固定样本进行维护。

三、样本替换

样本替换方法论可简化为两步骤模型:

  1. 根据目标调研对象和网络访问固定样本的特征,确定需要选取的匹配标准。
  2. 根据匹配标准,衡量两单元间的近似程度,确定最相似的单元作为原无回答单元的替换,收集后续作答。

如,目标调研对象中,账号1无法通过现有的渠道进行联系,但它具备可知的匹配标准A=2。

此时,设网络访问固定样本中某个体的匹配标准A=X,计算两者作差绝对值IX-AI;取使IX-AI取值最小时的账号2作为账号1的替换,用于后续作答。

衡量近似的过程有两点值得深思:

  1. 如果匹配标准包含多个变量,怎么去进行作差绝对值的比较?
  2. 如果存在多个账号均可使作差绝对值取最小,哪个账号才是最终的替换选择?可以多个账号的回答一起使用吗?可以的话他们间有优先次序吗?

上述疑惑均能在研究领域——“基于样本匹配的样本选择在网络访问固定样本中的应用”,找到与匹配准则选取相关的研究文献进行解决。

四、引子

样本替换是我读研期间的主要研究方向,过程的操作涉及到很多的理论方法,用户调研系列的方法论分享原是没有样本替换篇的书写计划,在这里作为一个想法进行抛出。

当然,之后也会结合自己PM工作进行实操案例介绍。

更关键的是提醒自己,知识永远都是力量,理论联系实际,这是读书的魅力

以上。

本文由 @场景阿侯-公众号同名 原创发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于CC0协议。

本文由 @场景阿侯 原创发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于CC0协议。

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。