惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V2EX - 技术
V2EX - 技术
博客园 - Franky
The GitHub Blog
The GitHub Blog
Y
Y Combinator Blog
MongoDB | Blog
MongoDB | Blog
C
Check Point Blog
P
Proofpoint News Feed
雷峰网
雷峰网
F
Fortinet All Blogs
酷 壳 – CoolShell
酷 壳 – CoolShell
I
InfoQ
H
Help Net Security
T
Tailwind CSS Blog
博客园 - 聂微东
博客园 - 【当耐特】
S
Schneier on Security
The Hacker News
The Hacker News
I
Intezer
博客园 - 三生石上(FineUI控件)
量子位
AWS News Blog
AWS News Blog
T
The Exploit Database - CXSecurity.com
腾讯CDC
Hugging Face - Blog
Hugging Face - Blog
P
Palo Alto Networks Blog
P
Privacy International News Feed
V
Vulnerabilities – Threatpost
NISL@THU
NISL@THU
宝玉的分享
宝玉的分享
Cyberwarzone
Cyberwarzone
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
T
Threat Research - Cisco Blogs
Microsoft Azure Blog
Microsoft Azure Blog
B
Blog
T
The Blog of Author Tim Ferriss
Security Latest
Security Latest
H
Hacker News: Front Page
Vercel News
Vercel News
A
Arctic Wolf
L
LINUX DO - 热门话题
G
GRAHAM CLULEY
Simon Willison's Weblog
Simon Willison's Weblog
Google Online Security Blog
Google Online Security Blog
W
WeLiveSecurity
Scott Helme
Scott Helme
Hacker News - Newest:
Hacker News - Newest: "LLM"
O
OpenAI News
TaoSecurity Blog
TaoSecurity Blog
Jina AI
Jina AI
爱范儿
爱范儿

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
Chrome 开了一个危险的头:偷偷给数亿电脑塞 4GB Gemini 模型,占硬盘、耗算力、删了自动重下
Tina · 2026-05-09 · via InfoQ - 促进软件开发领域知识与创新的传播

安全研究员 Alexander Hanff(网名 ThatPrivacyGuy)报告称,Chrome 一直在静默安装本地 Gemini Nano 大模型。它会以一个名为 weights.bin 的文件形式,存放在用户 Chrome 配置目录下的 OptGuideOnDeviceModel 文件夹中。

只要 Chrome 判断你的设备满足硬件要求,这个 4GB 的下载就会自动发生。整个过程既不会请求授权,也不会发送任何通知。此外,如果你找到并删除该文件,Chrome 会自动下载一份新的副本并恢复它。

事件引发争议后,谷歌昨天发表声明称,自 2024 年起他们就开始为 Chrome 提供 Gemini Nano 这一轻量级“本地模型”,并表示已逐步推出关闭选项。但声明回避了透明度和用户同意的核心问题——从头到尾,没人问过你同不同意。

14 分 28 秒:Chrome 如何把 Gemini Nano 写进用户磁盘

就在不久前,也就是 2026 年 5 月初,Alexander Hanff 公开了自己的发现。而在此之前两周,他刚刚揭露过 Anthropic 的一项类似操作:Claude Desktop 会在用户电脑上,悄悄向七个基于 Chromium 的浏览器注册一个“桥接程序”。换句话说,用户启动产品 A 时,Anthropic 会安装这个桥接程序,并在未经用户许可的情况下,把配置信息写入用户安装的产品 B、C、D、E、F、G、H 中(如 Brave、Edge、Arc、Vivaldi、Opera 等)。

并且这涉及到对大约 300 万台 Claude Desktop 用户设备进行了浏览器自动化预授权,当时,Hanff 写道:“这种做法突破了厂商的信任边界。没有征求用户同意的对话框,也没有退出选项。”

他没想到的是,仅仅两周后,他又在 Google Chrome 上发现了几乎相同的模式。

在任何安装了 Chrome 浏览器的设备上,用户配置文件中都有一个名为 OptGuideOnDeviceModel 的目录。该目录下有一个名为 weights.bin 的文件。该文件大小约为 4 GB,是 Gemini Nano 权重文件,可用于运行设备端推理,也是 Google Prompt API 背后的基础组件之一。

关键是,Google 压根没问你。在 Chrome 设置里,并没有一个清楚的选项写着:“是否允许 Chrome 下载一个约 4GB 的本地 AI 模型?”也没有弹窗提示用户:接下来浏览器会占用你的磁盘空间,下载一个用于 AI 功能的模型文件。下载会在 Chrome 的 AI 功能启用时触发,而这些功能在最新版本的 Chrome 中默认启用。在任何满足硬件要求的设备上,Chrome 都会将用户的硬件视为交付目标并写入模型。

更麻烦的是,删除并不能解决问题。

已经有多个 Windows 用户报告了同样的循环:用户手动删除,过一段时间,Chrome 又把它下载回来;用户再次删除,Chrome 再次恢复。这个过程反复发生,唯一的办法是去 chrome://flags 里关闭相关 AI 功能,或者彻底卸载 Chrome。

在 macOS 上,情况略有不同:该文件权限为 600,归用户所有(因此理论上可以删除)。但 Chrome 会在写入文件后,将安装状态保存在 Local State 中,一旦 Chrome 的灰度配置服务器再次判断该配置文件符合条件,下载就会再次触发。也就是说,权限机制不同,但整体逻辑一样:用户删掉的,只是文件本身;Chrome 仍然认为它应该存在。

Hanff 还在一台全新的 macOS 设备上进行了独立验证。他利用 macOS 内核维护的 .fseventsd 文件系统事件日志,追踪了整个安装过程。这个日志不受 Chrome 或 Google 控制,会记录操作系统层面的文件创建、修改和删除事件。

日志显示,2026 年 4 月 24 日 16:38:54,Chrome 在审计配置文件中创建了 OptGuideOnDeviceModel 目录;16:47:22,Chrome 启动多个解包进程,其中一个开始写入 weights.bin、模型配置和校验文件;到 16:53:22,解包完成,weights.bin 及相关配置被移动到最终位置。

从目录创建到模型落位,整个过程只用了 14 分 28 秒。而且在这段时间里,这个 Chrome 配置文件没有任何真实用户输入,也从未打开过任何 AI 相关界面。前台浏览器可能只是按审计流程加载网页、等待倒计时结束,后台却已经完成了一个约 4GB 本地 AI 模型的下载、解包和安装。整个过程没有弹窗,没有通知,也没有任何“是否允许”的对话框。

Google 的潜台词:我先下载,你不同意再自己去关

对于这场争议,Google 的回应透露出一个关键信息:Gemini Nano 进入 Chrome 并不是最近才发生的事。按照官方的说法:

“自 2024 年以来,我们一直为 Chrome 浏览器提供 Gemini Nano,它是一款轻量级的本地安全模型。它支持重要的安全功能,例如欺诈检测和开发者 API,而无需将您的数据发送到云端。虽然它需要占用一些本地桌面空间才能运行,但如果设备资源不足,该模型会自动卸载。今年 2 月,我们开始逐步推出一项功能,允许用户直接在 Chrome 设置中轻松关闭和移除该模型。禁用后,该模型将不再下载或更新。”

换句话说,这项“静默部署”已经持续了一年多,只是最近才被大规模曝光。而在社区里,关于这个模型的讨论其实更早就有迹可循:2025 年 4 月,Reddit 上有人发现这个缓存模型占了他 3GB 空间;到了同年 11 月,Stack Overflow 上的提问显示它已经涨到了 4GB。

据分析,Chrome 会下载两个版本的 Gemini Nano:一个是适用于 GPU 的版本,体积约 4GB,根据 GPU 性能的不同,可选择“最高质量”(HIGHEST_QUALITY)或“最快推理”(FASTEST_INFERENCE)两种运行模式;另一个是适用于没有 GPU 的设备的 CPU 版本,体积约 2.7GB。

Google 管这个模型叫“Nano”——纳米级,听起来很小巧。但对于用户存储空间本就有限的设备来说,一个 4GB 的“纳米”模型多少有些讽刺。

谷歌的声明也并未真正回应外界对透明度和用户同意的广泛批评。其立场很明确:下载是故意的,与 Chrome 的 AI 功能有关。如果用户不希望本地存储这个模型,现在可以选择手动退出。

更值得关注的是它的覆盖范围:Chrome 全球用户大约在 34.5 亿到 38.3 亿之间,市场占有率长期维持在 64% 以上。即便只有部分设备满足硬件要求,被影响的依然是数亿台桌面设备。这意味着,Google 正在进行的,已经不是一次普通功能更新,而是一场全球规模的“本地 AI 预部署实验”。

令人费解的事情之一是 Chrome 地址栏上那个显眼的“AI 模式”按钮,实际上依赖的是云端处理,而不是本地的 Gemini Nano 模型。这就让人不得不问:既然那个最常用的 AI 功能根本用不到本地模型,那 Chrome 为什么非要提前把这 4GB 塞进你的硬盘?

而且,更值得玩味的是,Chrome 148 版本刚刚悄悄移除了此前版本中“设备端 AI 不会将你的数据发送到 Google 服务器”的声明。连这句承诺都没了,数据去向可想而知。

有开发者给出了一个合理猜测:这本质上是一个概念验证方案——它既能把计算成本转移到用户设备上,同时还能继续收集查询元数据。

如果有足够多的 Chrome 用户安装了它,Google 就可以开始做分组实验,对比“云端完整版模型”和“设备端 Nano 模型”生成的结果差异。如果本地模型的输出质量足够接近,或者用户能够接受,那么 Google 就可以逐步把这些查询从自己的服务器卸载到用户设备上,而且不会遭遇太大的阻力。

现在,无论是设备性能(尤其是手机),还是模型优化技术,都已经成熟到这样一种程度:大多数普通用户(非开发者、非 IT 从业者)根本不会注意到,自己搜索“苹果派怎么做”时看到的结果,到底来自本地模型,还是来自数据中心里的大型云端模型。

但这一切的代价,远不止占点硬盘空间。

Hanff 认为,Chrome 正在向数亿台设备推送一个 4GB 的二进制文件,这会带来可衡量、可量化,而且相当令人担忧的环境影响。

按照他的测算,仅把这个 4GB 模型传输到一台设备,就会产生约 0.06 kg 二氧化碳当量排放。如果覆盖 5 亿台设备,总排放将达到 3 万吨 CO₂e,相当于 6500 辆汽车一整年的尾气排放;如果覆盖 10 亿台设备,这一数字将升至 6 万吨。而这还只是初始推送的成本。用户删除后重新下载、模型后续更新、本地推理运行,都会继续把这笔账往上推。

但比气候账单更值得警惕的,是这件事背后的趋势。Anthropic 和 Google 做了同一件事:先动手,让用户自己去发现后果。用户的设备被当成了部署目标,而不是由用户主动控制的东西。对平台受益的功能默认开启、藏在角落、难以移除——转向设备端 AI,非但没有改变这种暗黑模式,反而在加速它。

Chrome 这个“危险的头”已经开了。而且,这不是 Google 一家的事——Anthropic 试过了,Google 铺开了,微软、苹果会站在旁边看吗?“本地算力强征”是否会在从个别厂商的试探,变成整个行业的默认选项?

也许唯一能让这个趋势停下来的,不是某家公司的“良心发现”,而是足够多的用户知道这件事、感到不舒服,并且开始追问一句:我的设备,到底谁说了算?

参考链接:

https://news.ycombinator.com/item?id=48019219

https://adsm.dev/posts/prompt-api/

https://www.androidauthority.com/google-chrome-weights-bin-file-statement-3664379/

https://www.theregister.com/ai-and-ml/2026/05/07/chrome-silently-installs-a-4-gb-local-llm-on-your-computer/5230893