惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Y
Y Combinator Blog
有赞技术团队
有赞技术团队
J
Java Code Geeks
H
Hackread – Cybersecurity News, Data Breaches, AI and More
美团技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Hugging Face - Blog
Hugging Face - Blog
人人都是产品经理
人人都是产品经理
酷 壳 – CoolShell
酷 壳 – CoolShell
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
C
Check Point Blog
博客园 - 【当耐特】
The GitHub Blog
The GitHub Blog
Recent Announcements
Recent Announcements
The Cloudflare Blog
Microsoft Azure Blog
Microsoft Azure Blog
腾讯CDC
Vercel News
Vercel News
IT之家
IT之家
MyScale Blog
MyScale Blog
博客园_首页
Martin Fowler
Martin Fowler
WordPress大学
WordPress大学
罗磊的独立博客

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
论关于GPT发展的异样感及其思考
SiegZhong · 2023-06-12 · via 人人都是产品经理

这篇文章主要讨论生成式AI领域的发展,尽管该领域技术日新月异,但其中仍存在一些问题。作者就这些问题进行思考,并对微观、宏观两个层面提出对应的建议。希望能对你有所帮助。

在当前火热的生成式AI行业中,大模型的技术日新月异,对于那些一无所知的人来说,就如同面对着未知的世界,无所适从。

可以说,在这些领域上没有足够的技术知识,就像是当今社会的文盲一样,可能会错失很多机会。

然而,随着越来越多的企业、创业团队和研究机构进入这个领域,个人感到颇为奇怪,觉得这个领域的发展过快,仿佛有什么不对劲的地方。

这是一个非常有价值的话题,因此想在这里简要分享一下想法。

一、GPT发展的异样感

1. 要做中国的类ChatGPT

从各大厂商推出的大模型产品来看,它们借助自身的研发实力和财力,推出了文心一言、通义千问等产品,并早先进行内测和应用。

但是,其本质上的思路都是仿照OpenAI的思路,通过数据和预训练模型打造中国版的ChatGPT。初看起来,这似乎是适合我们发展的道路。

但这里面其实有着我们目前无法解决的两个关键问题:

  1. 算力问题。如我国目前仍未有类似于英伟达的NVlink技术(将多个芯片连在一起的带宽技术,从而可以提供更为强大的计算能力),而这项技术是训练大模型的关键技术之一。
  2. 数据问题。在ChatGPT的训练数据中,中文数据占比仅为0.09905%,优质数据相较于其他语言,占比太少。

以上两个问题,个人认为是涉及到大模型行业发展的最重要的问题,没有之一。

其中,问题1目前国内并没有可以攻克的实力,更多的需要依赖国外的技术支持。

问题2关于中文数据的问题,目前中文在全世界应用的范围有限,在解决中文数据质量及数量问题上,仍需要时间。

2. 耗能及成本问题

根据《ChatGPT挑起的这场AI竞赛,有一个肮脏的秘密》描述:训练GPT-3消耗了1287兆瓦时,并导致超过550吨二氧化碳的排放——相当于一个人在纽约和旧金山之间往返550次。

大模型的训练成本不是一个中小型甚至是大型公司能够轻易承受的成本。此外,还需关注环境、灾害管理和训练方法等课题。这些因素会导致企业面临高昂的成本问题。

尽管我个人认为很多初创公司的思考仍然不够,但这并不影响认为这是一个需要关注的问题。

很多公司仍在喊口号:“未来,我们要打造属于XX行业的大模型”。仅注重应用场景的深度和广度,并未提及到自身企业的优势、成本及技术经验的储备。

3. 大模型行业陷入了“内卷”的恶性循环

类似于以往互联网、电商的发展,很多企业(包括openAI)已经在疯狂抢夺大模型人才。相关JD描述不少都是需要有大模型训练、GPT使用工具经验及prompt工程等要求。而这些在2022年前,都还不为大众所熟悉。

薪酬方面只要牵扯到GPT大型模型相关的,基本都保持在20w-80w的高水平(以深圳为例)。

另外大模型也出现了不少行业大模型,如BloombergGPT(金融)、MathGPT(数学)等,未来肯定还有更多行业属性的大模型出现。

但这个是很奇怪的一个现象,类似于以往的语音agents,又将通用智能割裂成一个又一个模块。后面也许又会变成比较哪一个行业大模型更智能的问题上。

二、引发的思考

1. 宏观层面

1)国家层面

  1. 制定大模型、生成式AI的相关政策支持及监管,持续不断地推进大模型行业发展。
  2. 探讨在国内应用生成式AI的可行性,与各大高校、研究机构及企业合作,可能还需要海外机构,逐步在各行业进行应用。
  3. 更新或者设立高等院校的关于生成式AI的相关专业,另外还要注重芯片研发、统计科学及人工智能专业的发展。

2)企业层面

  1. 积极拥抱国外的先进技术,探索出存在差异化的产品定位/思路,从其他赛道超过美国,而不是从数据、算力方面突破。
  2. 做好后备资金及研发投入的支持,在保证自己能存活的前提下,鼓励创新及发展。

2. 微观层面

从业者或者期望从业者

  1. 自主学习。尝试使用各类生成AI工具,在生活、工作及学习中使用,有时间可以整理分析各类AI工具的竞品分析材料.
  2. 尝试应聘相关AI产品岗位时,带着你的思考和总结材料(如对目标公司的产品分析及产品原型,特别是AI相关的场景应用)去应聘,不用很详细,但最好有自己的独到见解。
  3. (慎用)考虑是否有必要进修。AI行业本身就是存在一定门槛,很多时候对技术的学习需要系统化,结合自己的情况,了解海外或者国内比较有名的院校(一般都是人工智能、数据科学、计算机等专业)。

针对第三点尤其要提的是,由于当前国内的学历贬值现象比较严重,深造是机会成本较高的选择,无论是跨学科还是非跨学科,都有时间、经济和精力相关的成本。毕业后的就业也是一个挑战,所以需要结合自身情况,仔细考虑是否进修。

参考内容

hanniman,“最近ChatGPT这么火,总感觉有点不对劲”。

本文由 @SiegZhong 原创发布于人人都是产品经理,未经许可,禁止转载

题图来自 Unsplash,基于 CC0 协议

该文观点仅代表作者本人,人人都是产品经理平台仅提供信息存储空间服务。