惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

月光博客
月光博客
人人都是产品经理
人人都是产品经理
博客园 - 聂微东
WordPress大学
WordPress大学
S
SegmentFault 最新的问题
博客园 - Franky
V
V2EX
Y
Y Combinator Blog
Google DeepMind News
Google DeepMind News
J
Java Code Geeks
T
The Blog of Author Tim Ferriss
罗磊的独立博客
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Jina AI
Jina AI
博客园 - 叶小钗
F
Fortinet All Blogs
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
A
About on SuperTechFans
M
MIT News - Artificial intelligence
云风的 BLOG
云风的 BLOG
Last Week in AI
Last Week in AI
D
Docker
博客园 - 【当耐特】
阮一峰的网络日志
阮一峰的网络日志

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
无论好坏,“推理”人工智能模型已成为一种趋势
世界模型工场 · 2024-12-17 · via 人人都是产品经理

“推理 AI 模型兴起,前景机遇挑战并存。” 在人工智能领域,推理模型成为新趋势。它们究竟为何备受关注?又面临着哪些困境与争议?未来发展之路在何方?

推理模型让AI走得更远,但它的成本却让人望而却步。

在OpenAI发布其所谓的推理模型o1之后,来自竞争对手AI实验室的推理模型如雨后春笋般涌现。

今年11月初,由量化交易员资助的AI研究公司DeepSeek发布了其首个推理算法DeepSeek-R1的预览。同月,阿里巴巴的Qwen团队也推出了他们声称是首个“开放”版的o1挑战者。

那么,是什么引发了这一波浪潮呢?其中一个原因,是寻找创新的方法来优化生成型AI技术。正如我的同事Max Zeff最近报道的那样,“暴力破解”式的技术,虽然曾经帮助模型规模化取得进展,但如今已经无法带来过去那样的提升。

AI公司面临着激烈的竞争压力,必须保持当前创新的步伐。根据估算,全球AI市场在2023年已达到1966.3亿美元,预计到2030年将增至1.81万亿美元。

OpenAI表示,推理模型能够“解决比以前更难的问题”,并代表了生成式AI发展的一个重大进步。但并不是每个人都确信推理模型是未来发展的最佳路径。

卡内基梅隆大学的机器学习副教授阿米特·塔尔沃卡(Ameet Talwalkar)表示,他对首批推理模型感到“相当印象深刻”。但他也同时提到,他“会质疑那些坚定声称知道推理模型会将行业带向何方的人”。

塔尔沃卡说:“AI公司有财务动机去描绘他们技术未来版本的光明前景。我们面临的风险是,过于狭隘地关注单一范式,这就是为什么更广泛的AI研究社区必须避免盲目相信这些公司所宣扬的炒作和市场营销,而是应该聚焦于切实的结果。”

推理模型的两个主要缺点是:一是成本高,二是能耗大。

以OpenAI的API为例,使用其推理模型o1,OpenAI收费每分析约75万字为15美元,每生成约75万字为60美元。这是OpenAI最新的“非推理”模型GPT-4o的3到4倍费用。

o1可以在OpenAI的AI驱动聊天平台ChatGPT上免费使用,但有使用限制。然而,OpenAI本月早些时候推出了一个更高级的o1版本——o1 Pro模式,年费高达2400美元。

加利福尼亚大学洛杉矶分校计算机科学教授盖伊·范登布罗克(Guy Van Den Broeck)告诉 TechCrunch:“大型语言模型推理的总体成本肯定不会下降。”

推理模型成本如此高的一个原因是,它们在运行时需要大量的计算资源。与大多数AI不同,o1和其他推理模型在生成内容时会进行自我检查,这帮助它们避免了通常困扰其他模型的陷阱。然而,这种自我验证也意味着它们往往需要更长的时间来得出结论。

OpenAI预计,未来的推理模型将“思考”数小时、数天甚至数周。尽管使用成本会更高,OpenAI承认,但这些推理模型可能带来的突破性成果,从新型电池到新型癌症药物很可能是值得的。

然而,今天的推理模型在价值上并不那么显而易见。非营利组织Ai2的研究员兼机器学习工程师Costa Huang指出,o1并不是一个非常可靠的计算器。社交媒体上的简单搜索也能找到许多o1 Pro模式的错误。

“这些推理模型是专门化的,可能在一般领域表现不佳,”Costa Huang告诉《TechCrunch》。“一些限制会比其他限制更早被克服。”

盖伊·范登布罗克认为,推理模型并没有真正进行推理,因此它们能成功解决的任务类型也有限。他表示:“真正的推理适用于所有问题,而不仅仅是那些在模型训练数据中可能出现的问题。这个挑战仍然是我们必须克服的主要问题。”

考虑到市场上强烈的动力推动推理模型的发展,我们可以合理推测它们会随着时间的推移不断改进。毕竟,不仅仅是OpenAI、DeepSeek和阿里巴巴在投资这一新兴的AI研究领域,风险投资家和来自相关行业的创始人也在聚集,共同展望一个由推理AI主导的未来。

然而,塔尔沃卡担心,大型实验室可能会“把控”这些进展。

“大型实验室出于竞争原因保持保密是可以理解的,但这种不透明性严重妨碍了研究社区与这些想法的互动,”他说。“随着越来越多的人朝这个方向努力,我预计[推理模型]将迅速发展。不过,虽然有些想法将来自学术界,鉴于此领域的经济激励,我预计大多数(如果不是全部)模型将由 OpenAI 等大型工业实验室提供。”(TechCrunch)

本文由人人都是产品经理作者【AI新智能】,微信公众号:【AI新智能】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。