惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 叶小钗
O
OpenAI News
V
V2EX
大猫的无限游戏
大猫的无限游戏
博客园 - 聂微东
S
Schneier on Security
C
CXSECURITY Database RSS Feed - CXSecurity.com
小众软件
小众软件
L
LINUX DO - 热门话题
C
Cybersecurity and Infrastructure Security Agency CISA
博客园 - Franky
Security Latest
Security Latest
S
SegmentFault 最新的问题
Project Zero
Project Zero
Spread Privacy
Spread Privacy
K
Kaspersky official blog
J
Java Code Geeks
V
Vulnerabilities – Threatpost
C
Cisco Blogs
C
CERT Recently Published Vulnerability Notes
月光博客
月光博客
T
The Exploit Database - CXSecurity.com
L
Lohrmann on Cybersecurity
人人都是产品经理
人人都是产品经理
博客园 - 三生石上(FineUI控件)
Scott Helme
Scott Helme
WordPress大学
WordPress大学
量子位
T
Threat Research - Cisco Blogs
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
宝玉的分享
宝玉的分享
Hugging Face - Blog
Hugging Face - Blog
AWS News Blog
AWS News Blog
Help Net Security
Help Net Security
Application and Cybersecurity Blog
Application and Cybersecurity Blog
Simon Willison's Weblog
Simon Willison's Weblog
S
Secure Thoughts
博客园 - 【当耐特】
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
V
Visual Studio Blog
Last Week in AI
Last Week in AI
T
Tailwind CSS Blog
腾讯CDC
Cyberwarzone
Cyberwarzone
IT之家
IT之家
GbyAI
GbyAI
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
云风的 BLOG
云风的 BLOG
T
Troy Hunt's Blog
D
Docker

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
Gemini 3.5深夜登场,谷歌CEO劈柴亲自算账:速度快4倍、一年还省超10亿美元,曝内部已被颠覆
华卫 · 2026-05-23 · via InfoQ - 促进软件开发领域知识与创新的传播

作者 | 华卫

北京时间 5 月 20 日凌晨 1 点,谷歌一年一度的 I/O 开发者大会准时开幕。

在发布新品前,谷歌 CEO Sundar Pichai 展示了一个惊人的数据:每月处理 3.2 千万亿个 token。“两年前,我们在各个平台每月处理约 9.7 万亿个 token。去年的 I/O 大会上,这一数字增长到了大约 480 万亿个 token。快进到今天,这个数字又跳升了 7 倍,每月超过 3.2 千万亿个 token。”

短短一年增幅达 7 倍。而这些 token,代表着谷歌用户、开发者与客户正在解决的各类问题。据透露,去年 I/O 大会时拥有 4 亿月活跃用户的 Gemini 应用,如今已突破 9 亿,一年内翻了一番多。截至目前,Nano Banana 图像生成模型已生成超过 500 亿张图像。

“还有大量潜在的生产力等待被释放。“Pichai 称。而这次的 I/O 发布,“智能体”可谓是重头戏。几乎所有的重磅新品,都是围绕智能体去迭代和更新的。

Gemini 3.5 登场,彻底改变谷歌内部工作方式

Gemini 3.5 Flash 是此次 I/O 最值得开发者关注的发布,被称为谷歌“迄今为止最强大的智能体和编码模型”。在多项智能体和编码基准测试中得分均高于 Gemini 3.1 Pro,运行速度比其他前沿型号快 4 倍。

对于这款模型,Pichai 特意强调了两点。

第一,与 3.1 Pro 相比,3.5 Flash 在几乎所有基准测试中表现更佳。它在编码能力上取得了巨大进步,尤其是 GDPVal 的飞跃非常显著,反映了许多现实世界中具有经济价值的任务。在 Terminal-Bench 2.1(76.2%)、GDPval-AA(1656 Elo)和 MCP Atlas(83.6%)等具有挑战性编码和代理基准测试上的表现优于 Gemini 3.1 Pro,并在多模态理解方面领先(CharXiv Reasoning 为 84.2%)。

第二,Gemini 3.5 Flash 在多个维度上提供可媲美大型旗舰机型的智能性能,但速度仍然非常快。以每秒输出 token 数计算,它比其他前沿模型快 4 倍。

此外,Gemini 3.5 Flash 的另一个惊人之处在于,它以不到可比前沿模型一半的成本提供前沿级能力。“我们听说许多公司在五月就已经超出了年度 token 预算。如果公司能够将 Flash 与其他前沿模型混合使用,就可以节省大量成本。举个例子,顶尖公司每天处理约 1 万亿个 token。如果他们将 80% 的工作负载从其他前沿模型切换到 3.5 Flash,每年可节省超过 10 亿美元。这是真实的节省,可以再投入到公司的发展中。”Pichai 表示。

过去一年,AI 编程工具的市场是 Cursor、Claude Code、GitHub Copilot 三家在争。Google 在这个赛道几乎缺席。有消息说,Gemini 团队在编程方面挣扎了一段时间。这次的 Gemini 3.5 系列,就像是谷歌最新的正面回应。

今天起,Gemini 3.5 Flash 在谷歌的所有产品和 API 上向所有人开放。

“新模型在谷歌内部彻底改变了我们的工作方式。”Pichai 表示,他们一直在将 3.5 Flash 与重新构想的以智能体为核心的开发平台 Antigravity 一起使用,显著加快了开发速度。“3 月,我们在内部 AI 开发工具中每天处理约 5000 亿个 token,之后每隔几周就翻一倍。现在,我们每天处理的 token 数量已经超过 3 万亿。如此规模创造了强大的反馈循环,帮助我们不断改进 3.5。”

下个月,谷歌预计推出 Gemini 3.5 Pro。据悉,谷歌在内部已经在使用它,其显示出很大的改进。

Gemini Omni:将你的想法转化为电影视频

大会上,谷歌隆重推出新模型 Gemini Omni,能够从任意输入生成任意输出模态的样本。这一新模型将 Gemini 的智能与生成式媒体模型结合在一起,在现实世界理解上实现了巨大的飞跃。通过 Omni,用户可以将图片、音频、视频和文本作为输入结合,生成基于 Gemini 真实世界知识的高质量视频,也可以通过对话轻松编辑视频。

“借助世界模型,人工智能正从预测文本转向模拟现实。我们一直在努力突破这些模型的边界。”Pichai 表示,Gemini Omni 将从视频输出开始,随后会支持图像和文本。

今日起,谷歌将正式上线 Omni 系列的 Flash 版本,可以在 Gemini 应用、Google Flow 和 YouTube Shorts 上试用,未来几周通过 API 向开发者和企业客户推广。

据介绍,Gemini Omni 的特别之处是让视频编辑变得更简单,只需自然语言,可以修改特定事物或者改动整个场景,还可以修改环境、角度、风格,甚至具体细节,同时始终保持原始场景的连贯性。并且,每条指令都可以在前一条的基础上继续操作,角色保持一致,物理规律得以维持,场景也记得之前发生的事情。

除了构建逼真的场景,Gemini Omni 还能推理接下来应该发生什么。它可以将对物理规律的直觉理解与 Gemini 对历史、科学和文化背景的知识结合起来,实现从照片级真实到有意义故事讲述的跨越。Omni 还能利用 Gemini 的知识,将语言、图像和意义联系起来,其能力远超简单的模式匹配。

不过,所有用 Omni 制作的视频都包含肉眼几乎察觉不到的 SynthID 数字水印,用户可以通过 Gemini 应用、Chrome 中的 Gemini 和 Google 搜索轻松验证视频是否是用 Gemini Omni 生成的。

两款智能体加持,Gemini 应用更“实用”了

对于 Gemini 应用来说,这一年是丰收的一年。去年在谷歌 I/O 大会上,Gemini 服务了 4 亿用户。如今,每月有超过 9 亿人在 230 个国家、70 多种语言中向 Gemini 寻求帮助。

据介绍,Gemini 应用来新增了两个智能体功能。首先是晨间摘要智能体 Daily Brief ,它基于近期 Google Labs 实验 CC 的成功经验,让用户可以无缝、直观地进入 AI 智能体的世界。一旦你选择加入,Gemini 会在后台跨你已连接的应用运行。它会从 Gmail 收件箱收集紧急更新,从日历跟踪即将发生的事件,并将相关的后续信息整理成一份易于浏览的简报。

而且,Daily Brief 的功能远超简单的摘要。它会根据你的具体目标主动组织和优先排序内容,甚至会建议你立即可采取的下一步行动。你还可以通过简单的“点赞”或“点踩”反馈来引导它的行为,使其越用越懂你。今天起,Daily Brief 开始向美国的 Google AI Plus、Pro 和 Ultra 用户推出。

谷歌还推出了 Gemini Spark,这是一款全天候 24/7 个人 AI 智能体,标志着 Gemini 的一次重大转变:从一个可以回答问题的助手,升级为一个可以在用户的指示下实际完成工作、成为主动合作伙伴的智能体。

“我对 Gemini Spark 特别兴奋。它是 Gemini 应用中的个人 AI 智能体,可以帮助你管理数字生活,根据你的指令代你执行操作。”Pichai 表示。

据介绍,Gemini Spark 基于 Gemini 3.5 并使用 Antigravity 框架,与你日常依赖的 Workspace 工具(如 Gmail、Docs、Slides 等)深度集成。更棒的是,因为它是基于云的智能体,即便你关闭笔记本或锁屏手机,Spark 也会在后台持续工作。这意味着 Spark 可以承担复杂任务,让你腾出时间专注于最重要的事情。

使用 Gemini Spark,你可以设置重复任务或触发器,自动解析每月信用卡账单,标记新增或隐藏的订阅费用;教它新技能,让它定期检查孩子学校的邮件更新,提取关键截止日期,并将每日汇总简报发送给你和你的伴侣。创建完整工作流,让它整合邮件和聊天中的会议原始记录,生成整理好的 Google Docs 文档,甚至起草启动项目的配套邮件。

这仅仅是开始, Gemini Spark 有丰富的功能路线图。今天,谷歌扩展了 Gemini 连接应用列表,通过 MCP 新增了 Canva、OpenTable 和 Instacart 的连接。未来几周,Spark 将可以利用这些 MCP 连接完成更多任务。之后,谷歌还将增加新能力,包括通过短信和邮件与 Spark 互动、创建自定义子智能体以及操作本地浏览器。

据悉,Spark 会完全在用户的指挥下运行。用户可以选择是否启用它,以及连接哪些应用;在执行高风险操作(如花费资金或发送邮件)前,它会先征求确认。Gemini Spark 本周将向受信任测试者推出,计划下周向美国 Google AI Ultra 用户推出 Beta 版本。

25 年来搜索最大升级:AI 带来新纪元

同时, 谷歌带来了 25 年来 Search 框的最大升级:全面 AI 化。

“随着我们进入这个智能体时代,搜索将比以往任何时候都更有帮助和强大。”Pichai 说道。据介绍,谷歌在 Search 中引入了信息智能体。这些是用户可以设置的个性化 AI 智能体,它们可以在后台全天候工作,在你最需要的时候找到信息,并帮助你执行操作。据介绍,信息智能体将在今年夏天逐步推出,首先面向 Google AI Pro 和 Ultra 用户。

“我们构建真正智能体化 Search 的另一种方式是赋予其智能体编程能力。”现在,Gemini 3.5 Flash 已经成为全球用户在 Google 搜索 AI 模式下的全新默认模型。“凭借 Gemini 3.5 Flash 和 Google Antigravity 的强大能力,Search 可以为用户的每个问题创建个性化体验,例如动态布局和交互式可视化。这些生成式 UI 功能将在今年夏天向所有用户免费开放。”

对于需要长期持续处理的任务,Search 还能更进一步创建持久化、定制化的仪表盘或追踪器,用户可以随时返回并继续操作,可以把它们看作是为特定任务定制的迷你应用。未来几个月,用户将能够在 Search 中使用 Antigravity 构建个性化体验,首批面向美国的 Google AI Pro 和 Ultra 用户。

另外,谷歌还致力于让用户与 Search 的对话更简单顺畅。用户可以直接在 AI 概览界面提出后续问题,并通过 AI 模式进行连续的对话交流。上下文信息会随你保留,随着深入探索,相关链接和参考文章也会变得更加精准,这个无缝体验已在全球桌面和移动端上线。

从今天起,新的智能 Search 框开始在所有支持 AI 模式的国家和语言中逐步推出。