惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
云风的 BLOG
云风的 BLOG
小众软件
小众软件
V
V2EX
博客园 - Franky
博客园 - 司徒正美
Apple Machine Learning Research
Apple Machine Learning Research
量子位
博客园 - 【当耐特】
雷峰网
雷峰网
WordPress大学
WordPress大学
Jina AI
Jina AI
Google DeepMind News
Google DeepMind News
N
Netflix TechBlog - Medium
爱范儿
爱范儿
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
阮一峰的网络日志
阮一峰的网络日志
IT之家
IT之家
Blog — PlanetScale
Blog — PlanetScale
Hugging Face - Blog
Hugging Face - Blog
H
Hackread – Cybersecurity News, Data Breaches, AI and More
V
Visual Studio Blog
Microsoft Security Blog
Microsoft Security Blog

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
数据的五个特征、三道难题、一种自大
腾讯研究院 · 2023-06-06 · via 人人都是产品经理

数据是一种客观存在,是关于事物的事实描述,可通过测量、记录、发现等方式去获得。数据具有无限性、易复制性、非均质性、易腐性和原始性五个特征。数据和信息至关重要,但当下有三道难题困扰着数据健康有序发展,即数据确权、数据交易和数据要素,一起来看看文章的具体分析吧!

“数据是新石油”(Clive Humby,2006)。如果一定要找出一样,数据最像的还真是石油。两者都是重要的战略资源,都是驱动世界的动力。但数据只是数据,它不是其它任何东西。

一、五个特征

数据是一种客观存在,是关于事物的事实描述,可通过测量、记录、发现等方式去获得。数据具有无限性、易复制性、非均质性、易腐性和原始性五个特征。

1. 无限性

与实物不同,数据不会因使用而耗尽,反而是因使用而产生,会不断被创造,会越来越多。“数据将成为最基本的客观产物,无论做什么,我们都在产生数据”(Paul Sonderegger,2017)。根据DASA R&T《2016-2045年新兴科技趋势》,全球新产生的数据量大约每两年翻一番。这堪称大数据摩尔定律,数据大爆炸是必然。

2. 易复制性

数据可以快速地以近乎零成本的方式进行复制,可供多人同时使用,可多次循环使用,一个人的使用可以不排斥和妨碍别人对其使用,不同人之间在使用上不存在直接的利益冲突。易复制性使得数据具有一定程度的非竞争性和非排他性,但数据不是公共品,有公共数据、企业数据和个人数据之分。

3. 非均质性

《潜伏》中谢若林有句话:“现在两根金条放在这儿,你告诉我哪一根是高尚的,哪一根是龌龊的?”这说明了一个道理——金条是均质的,两根金条有着同等的价值表现。均质性普遍存在,例如出厂的商品、油电气等能源。而数据是非均质的,一比特数据跟另一比特数据所包含的价值完全不同,同一份数据对不同人的价值也不一样。正如王钦敏(2023)所说:“数据价值因使用对象而异,因应用场景而异,因专业化数据质量标准而异。”

4. 易腐性

数据是一种易腐品,会随着时间的流逝而迅速贬值。根据IBM(2015)数据,60%的非结构化数据在几毫秒内就失去真正价值。这意味着,数据的价值很大程度体现在时效性上,超过一半的数据在产生的那一刻就不再有价值,我们可称之为“一秒钟定律”。能得到分析处理并产生实际效用的数据则更少。全球90%的数据从未得到分析使用(IBM,2015;DASA R&T,2016)。2020年被创建或复制的数据中,只有不到2%被保存并保留到2021年(来源:IDC)。

5. 原始性

数据是原始的,本身并没有意义,只有对它进行处理分析,才能转变成对人们有用的信息。如果说数据是新石油,那么分析就是内燃机。信息是数据提炼后的产物;信息经人脑加工后形成知识,知识具有主观性;数据、信息和知识是历史的,而智慧是关于未来的,是人们运用知识做出决策和判断的能力。

对数据、信息、知识和智慧之间的关系,福特汉姆大学Zeleny教授(1987)提出了DIKW金字塔模型(如下图所示),从底层到顶层依次是:

  1. 数据(Data):Know nothing,一无所知;
  2. 信息(Information):Know what,知道是什么;
  3. 知识(Knowledge):Know how,知道怎么做;
  4. 智慧(Wisdom):Know why,知道为什么。

图 DIKW金字塔模型

二、三道难题

一个人和周围人的差距主要在于掌握信息、理解信息和运用信息的能力不同。数据和信息至关重要。但当下有三道难题困扰着数据健康有序发展,即数据确权、数据交易和数据要素。我们要迎难而上、敢于作为,以极大的勇气和智慧破解一切困难。

1. 数据确权

关云长身在曹营心在汉。对物理存在的身体之归属,我们比较容易判断;而内心和灵魂是缥缈不定的,具有不确定性、隐秘性和多元性,不乏同时属于多个主体的情况。数据与之类似,人们很难清晰判定它属于谁,很难对其进行有效的物理切割和合理的权利分配。确权的复杂性与数据本身的特征有关,也与权利主体的多样性有关。数据链条涉及多个参与者,他们缺一不可且无法单独发挥作用,具有不同的诉求。加之,数据的价值密度低,所产生的效益难以清晰衡量,这使得数据确权的成本极高。

2. 数据交易

交易是一种互利互惠的行为,是人类社会中最具自发性和最具积极性的活动。唯有双方都从中获益,交易才会发生。对数据而言,交易则是一个难题。联合国贸发会议(2019)指出:“数据具有重要的使用(或滥用)价值,但不像大多数经济商品那样具有交换价值。”现实中的交易一般具有明确的价格,是可重复、可预期的。例如,商店把明码标价的奶茶重复售卖给不同的消费者,消费者获得的效用是可预期的——止渴、美味、社交。数据非均质、价值不易衡量、定价困难、预期效用难以管理、有“搭便车”风险……这都是数据交易中要面对的问题。

3. 数据要素

生产要素是人们用来生产商品和劳务所必备的基本资源。它促进生产,但不会成为产品和劳务的一部分,也不会因生产过程而发生显著变化。新古典学派创始人马歇尔在其名著《经济学原理》(1890)中提出了生产要素四元论,即土地、劳动、资本和企业家才能。梅宏院士指出(2023):“把数据确立为重要的生产要素是中国的首创。”然而,在经济学上定义数据生产要素是一件困难的事情,尚未看到有影响力和说服力的成果,迫切需要经济学家们加紧研究。

三、避免大数据自大

提起数据挖掘的经典案例,很多人会想到“啤酒加尿布”和谷歌流感趋势。实际上前者是一个故事,早在1992年就已出现,并没有真正发生过;后者曾提前预测出流感到来,不过因后来的准确性太低而早已被关闭。

数据的重要性毋庸置疑。人们喜欢在“数据”之前加一个“大”字,以彰显非同寻常。人们也时常陷入“大数据自大(big data hubris)”的误区。数据能解决很多问题,但有局限性,通过数据难以预测突变。一只岁月静好的猪,无法通过既往数据预测出春节的黑天鹅;马车的出行数据,可以使人们获得“一匹更快的马”,但不能使人们发明出汽车。数据是企业的竞争优势,但不是万能的。一个好的APP不会因有历史数据就能高枕无忧,它时刻受到创新者的挑战,只能“各领风骚仅几年”;创业者哪怕没有数据、没有积累,也可以推出创新产品,获得用户,取得成功。从这个角度上说,没有数据也不是不行。

大数据时代,“要相关,不要因果”被奉为圭臬。“关键是人的分析推理找出为什么两件事物同时或相继出现,找对了理由才是新知识或新发现的规律,相关性本身并没有多大价值”(李国杰,2015)。只信“数”不如无“数”。我们要综合运用实验观察、逻辑演绎、归纳提炼等科学方法,探究事物之间的关系和规律,才能挖掘出有价值的信息和结论。

我们重视数据,根本上不是因为数据本身重要,而是尊重客观世界和客观规律的实事求是精神重要,数据即事实。正如李国杰院士(2015)所言:“重视数据就是强调用事实说话、按理性思维的科学精神。”

作者:闫德利

来源公众号:腾讯研究院(ID:cyberlawrc),腾讯研究院是腾讯公司设立的社会科学研究机构。

本文由人人都是产品经理合作媒体 @腾讯研究院 授权发布,未经许可,禁止转载。

题图来自 Pixabay,基于 CC0 协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。