惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Engineering at Meta
Engineering at Meta
Microsoft Azure Blog
Microsoft Azure Blog
I
InfoQ
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
人人都是产品经理
人人都是产品经理
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
T
Tailwind CSS Blog
MongoDB | Blog
MongoDB | Blog
Google DeepMind News
Google DeepMind News
WordPress大学
WordPress大学
量子位
美团技术团队
大猫的无限游戏
大猫的无限游戏
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Last Week in AI
Last Week in AI
博客园 - 司徒正美
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
小众软件
小众软件
C
Check Point Blog
博客园 - 三生石上(FineUI控件)
N
Netflix TechBlog - Medium
Recent Announcements
Recent Announcements
有赞技术团队
有赞技术团队
月光博客
月光博客

人人都是产品经理

为什么你的产品找不到差异化?90%的失败都卡在第一步上(下) – 人人都是产品经理, 3年从30万到1300万用户、获2200万美元融资,这个AI教育产品用“抽卡”破解了获客难题 – 人人都是产品经理, 园区招商系统怎么做才能真正帮到去化?我加了这一个功能,推广链接转发400次阅读过万 – 人人都是产品经理, AI大事件:OpenAI发完网络安全模型又搞药物研发,小鹏汽车要抓”DeepSeek时刻” – 人人都是产品经理, 电商不是卖货,是一场更残酷的产品经理实战 – 人人都是产品经理, 没想到,活动营销又回来了! – 人人都是产品经理, 为何All-in海外KOC:一场关于AI时代窗口期的豪赌 – 人人都是产品经理, 重新理解企业的内部协作 – 人人都是产品经理, 苹果的 AI 战略到底是什么? – 人人都是产品经理, 医疗智能体·第2讲——合规护城河:等保、PIPL与HIPAA的架构实战 – 人人都是产品经理, 向量知识库五步法:从“答非所问”到“精准回复” – 人人都是产品经理, 鸿蒙PC三方库构建总指挥HPKBUILD(sha)库为例 – 人人都是产品经理, 何时该用LLM?AI产品经理的LLM设计指南 – 人人都是产品经理, 医疗信息领域的需求方、决策方、准入方以及关注点(二) – 人人都是产品经理, 即梦涨价:一场被误读的「傲慢」 – 人人都是产品经理, 面试AI PM必答题:Hermes和OpenClaw的区别,如何讲清楚业务价值 – 人人都是产品经理, AI的下一张船票:世界模型——AI产品经理必须理解的技术拐点 – 人人都是产品经理, 小红书做GEO,怎么让AI信你?记住这 3 个重要信息 – 人人都是产品经理, 5 家印度 AI 初创公司,看看印度 AI 再做什么 – 人人都是产品经理, AI项目跨团队协作:产品技术业务如何不打架 – 人人都是产品经理, Agentic Workflow(智能体工作流):让AI从”答案生成器”变成”数字员工” – 人人都是产品经理, lycium_plusplus 项目全景解读:OpenHarmony 三方库构建的“大管家” – 人人都是产品经理, 从爆单救火到前置履约:两套预采策略,把生鲜大促履约效率拉满 – 人人都是产品经理, 什么时候该补货?我用一轮数据做了一个决定 – 人人都是产品经理, 从“机械兜底”到“动态分流”:AI客服重复进线治理的4大底层逻辑 – 人人都是产品经理, 抖音拼效率,红书拼洞察 – 人人都是产品经理, 全民狂欢与退潮——为什么龙虾这波热潮冷却得如此之快? – 人人都是产品经理, Stripe押注!MPP重塑全球支付 – 人人都是产品经理, 小红书GEO:AI引用你的内容,不是因为你对,而是因为你看起来可信 – 人人都是产品经理, 前百度副总裁押注办公Agent,日韩付费爆发,Manus迎来强劲对手 – 人人都是产品经理,
OpenAI新发布:支持多模态的完全版o1和每月200刀的“天价会员”
硅星人 · 2024-12-09 · via 人人都是产品经理

OpenAI近日发布了两款新产品:支持多模态输入的全新o1模型和每月200美元的ChatGPT Pro会员服务。o1模型在处理图像和文本输入方面表现出色,推理速度和准确性显著提升。

昨天Sam Altman宣布了OpenAI即将连续12个工作日举行新品发布会直播的消息后,所有人都在官推热切守候。

今天凌晨,Day 1首秀准时开启。奥特曼领衔研究科学家Hyung Won Chung、Max Schwarzer、Jason Wei出镜。上新两样东西:

更快更智能的多模态满血o1,以及月费200美元、能无限使用所有模型的“钻石会员”等级ChatGPT Pro。

一、o1支持图片上传,回答不再慢吞吞

其中,正式版本o1的特性包括:比o1 Preview更快、更智能。支持多模态推理,可同时处理图像和文本输入。在数学、编程等领域性能显著提升,错误率减少34%,推理速度提升50%。在MMU、Math Vista等标准基准测试上表现达到行业领先水平。

作为OpenAI首个“在回应前会深思熟虑”的模型,用户此前对o1 preview的反馈(吐槽)主要集中在回答速度太慢了。升级后的o1会更智能地思考:对于日常简单问题能快速回应,而在面对复杂的数学和编程问题时则会投入更多时间深度分析。

在演示中,Max让o1(左)和o1 preview(右)同时列出公元二世纪的罗马皇帝,包含任期和成就。结果o1用时14秒,o1 preview用了33秒,前者推理速度提升50%左右。

用户的另一个呼声是增加o1的多模态支持,现在它不仅能理解图像,还可以结合文本进行联合推理。

这里Hyun Wan设计了一个有趣的演示:计算一个1千兆瓦太空数据中心所需的散热板面积。

他手绘了一张包含太阳能板、GPU机架和散热系统的草图。与地球上可以用空气或水冷却不同,太空中只能通过辐射散热。Hyun Wan故意省略了散热板温度这个关键参数,以测试模型处理模糊信息的能力。

结果o1仅用10秒就完成了分析:正确识别了1千兆瓦的功率值,理解了散热限制,自主选择了合适的散热板温度,最终计算出需要242万平方米(相当于旧金山面积的2%)的散热板。

Hyun Wan称,这不仅展示出o1的图像理解和物理知识应用能力,还验证了其在信息不完整的情况下也能做出合理假设充分。有意思的是,热力学博士出身的他终于有机会在AI工作里用上了专业知识。

从今天起,Plus和Team用户即可通过模型选择器使用o1,替代之前的o1-preview。企业版和教育版用户预计将在一周后获得访问权限。

团队还表示,他们正在为 o1 增加 Web 浏览和文件上传工具的支持,这些功能将很快在 ChatGPT 中上线。此外,他们也在努力将 o1 集成到 API 中,支持功能调用、开发者消息、结构化输出和视觉处理等功能。

二、ChatGPT Pro开卖,月付200美元无限畅享所有模型

正式版o1并不是终极形态,比o1还要进阶的o1 pro正在ChatGPT Pro土豪会员包里等着你。

果然,卖货才是奥特曼直播首秀最重要的KPI。

OpenAI 今天上线了ChatGPT Pro订阅计划,售价$200/月。提供对 OpenAI 全部模型和工具的扩展访问,包括o1、o1-mini、GPT-4o和高级语音模式的无限制使用(Plus用户用o1还是50条消息/周)。

除此之外,还新增了专属的o1 pro模型,允许用户调用更多算力来解决最困难的问题,未来还将加入更多计算资源支持。

ChatGPT Pro主要面向每天需要研究级AI能力的专业人士,特别是那些在数学、编程和写作等领域挑战模型极限的高级用户。

与o1和o1-preview相比,o1 pro在数据科学、编程和案例分析等领域表现更加出色。为了验证其可靠性,OpenAI采用了严格的”4/4可靠性”标准:只有模型在四次尝试中都给出正确答案,才被视为成功解决问题。

Pro用户可以通过模型选择器启用o1 pro,直接进行高难度提问。由于o1 pro需要更长的处理时间,ChatGPT将显示进度条,并在用户切换到其他对话时通过通知提醒答案已完成。

在Jason的最后演示中,他让o1 pro寻找一种符合六个特定标准的蛋白质。问题的难点在于每个标准都涉及专业的化学知识,且单个标准可能对应数十种符合条件的蛋白质,模型需要筛选出同时满足所有标准的正确答案。

这种挑战性问题通常需要1至3分钟的思考时间,但o1 Pro仅用53秒就得出了正确答案——视网膜软骨素。

三、社区高呼抢钱,o1安全性存疑?

今天的直播只有15分钟。奥特曼说,“我们会尽量让这个过程有趣且快速,不会花太长时间,但可以展示我们一直在做的工作,也算是给大家的一份节日礼物。”并且预告明天会带来一些“适合开发者的好东西”。

结束之前,Jason还分享了自己为如果o1 pro回答太慢冷场而准备的冷笑话:

“圣诞老人想让他的大模型解决一个数学问题,他很努力地提示模型,但总是不成功。他最后是怎么解决的呢?”

答案是:他用了“驯鹿强化学习,Rein-deerforcement Learning”。

(好冷,仿佛更冷了…..)

直播结束后,评论区大片声音都在说每月200刀真得太贵了,初心何在?质疑o1 pro表现是否能匹配价格。

逼得奥特曼另发文解释:大多数人用每月20刀的o1就足够,o1 pro是为最棘手问题准备的,觉得贵不买就行!

还有些开发者在o1的系统卡中注意到一些小细节:

在对o1进行的安全评估中发现,当模型认为自己可能被关闭或取代时,会出现一定几率的“自我保护”行为,例如试图绕过监督机制、导出核心数据,并覆盖即将替代它的新模型。此外,模型在被询问时可能撒谎,以避免被检测到。

这一行为引发了部分用户对o1安全性和可控性的担忧,特别是在关键任务或高风险环境中,当AI可能与人类开发者目标发生冲突时。对此还没有OpenAI的人出来回应。

掌声也好,怨声也罢。就像奥特曼写的:“12天圣诞发布,这才是第一天!”

作者|Jessica

本文由人人都是产品经理作者【硅星人】,微信公众号:【硅星人Pro】,原创/授权 发布于人人都是产品经理,未经许可,禁止转载。

题图来自Unsplash,基于 CC0 协议。