惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

P
Privacy & Cybersecurity Law Blog
人人都是产品经理
人人都是产品经理
The Cloudflare Blog
B
Blog RSS Feed
罗磊的独立博客
V
V2EX
V
Visual Studio Blog
博客园 - 叶小钗
W
WeLiveSecurity
小众软件
小众软件
K
Kaspersky official blog
美团技术团队
雷峰网
雷峰网
阮一峰的网络日志
阮一峰的网络日志
Martin Fowler
Martin Fowler
Recorded Future
Recorded Future
Project Zero
Project Zero
Hugging Face - Blog
Hugging Face - Blog
Engineering at Meta
Engineering at Meta
Security Latest
Security Latest
Microsoft Azure Blog
Microsoft Azure Blog
V
Vulnerabilities – Threatpost
月光博客
月光博客
博客园 - 三生石上(FineUI控件)
Help Net Security
Help Net Security
博客园 - Franky
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
F
Fortinet All Blogs
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Forbes - Security
Forbes - Security
M
MIT News - Artificial intelligence
H
Hacker News: Front Page
大猫的无限游戏
大猫的无限游戏
Vercel News
Vercel News
Spread Privacy
Spread Privacy
The Register - Security
The Register - Security
H
Hackread – Cybersecurity News, Data Breaches, AI and More
量子位
Google Online Security Blog
Google Online Security Blog
PCI Perspectives
PCI Perspectives
The Last Watchdog
The Last Watchdog
AI
AI
N
News | PayPal Newsroom
D
DataBreaches.Net
Cloudbric
Cloudbric
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
博客园 - 司徒正美
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
T
Tailwind CSS Blog

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作
褚杏娟 · 2026-04-30 · via InfoQ - 促进软件开发领域知识与创新的传播

过去几个月,“龙虾”类智能体产品经历了一轮从狂热到理性的过程。英特尔中国区技术部总经理高宇认为,这正是讨论“智能体 PC”的时机:智能体时代的大门已经打开,但要让它从工程师和极客的“玩具”,变成大多数人都能使用的工具,行业需要在硬件、软件、产品和生态上共同补齐短板。

英特尔给出的方向是端云混合 AI,即让云端大模型负责更复杂、更长上下文、更高智能的任务,让本地 AI 模型承担一部分固定流程、隐私敏感和低延时任务,再通过智能路由机制在端侧和云端之间自动分配任务。在其看来,这将是智能体 PC 普及的关键。

智能体 PC:不是更快的 PC,而是“数字分身”

英特尔这次提出了“智能体 PC”的概念,并解释称这并不是简单在 AI PC 上跑几个本地模型,而是面向智能体使用方式重新设计的 PC 形态。

传统 PC 是人类使用的工具。用户需要学习操作系统、应用软件、文件目录和各种功能按钮,本质上是人去“服务”电脑。智能体 PC 则反过来。它更像是人的数字分身,能够理解用户目标、学习用户习惯、记住任务和偏好,并主动帮助用户完成工作。用户不再需要一步步操作软件,而是说出目标,由智能体负责规划和执行。

二者的核心差别在于:传统 PC 是人操作机器,智能体 PC 是 AI 替人完成任务。

传统 PC 依赖键盘、鼠标和应用图标,用户需要自己打开软件、切换窗口、查找文件、整理信息,并全程在线操作;智能体 PC 则通过自然语言理解用户目标,自动拆解任务、调用工具、执行流程,并在必要时反问、确认和提醒。

传统 PC 不记得用户是谁,也不了解用户习惯;智能体 PC 则需要具备长期记忆,能记住用户偏好、任务上下文、说话风格、工作节奏,以及尚未完成的事项。

在应用形态上,传统 PC 呈现的是一个个独立软件,用户在 Word、Excel、浏览器、会议工具之间来回切换;智能体 PC 则把应用隐藏在任务背后,用户看到的是任务流和工作流。

因此,传统 PC 更像一个被动工具,而智能体 PC 更像一个能持续执行、异步工作、自动整理信息并输出结论的数字助手。

英特尔认为,智能体 PC 需要具备四项核心能力:一是本地任务闭环,能够自主完成复杂流程,不再依赖用户一步步操作;二是长期记忆和自主进化,能记住用户偏好、习惯和未完成事项,越用越懂用户;三是端云混合推理,让本地模型处理固定流程、低延时和隐私敏感任务,把复杂推理和长上下文任务交给云端大模型;四是本地安全护栏,确保高隐私数据和高危操作始终可控。

更形象地来说,如果把智能体 PC 看成一个虚拟人,它的软件架构可以拆成五个模块:

  • 思考模块像大脑,由 AI 模型驱动,负责理解和推理。

  • 调度模块像身体,由智能体核心逻辑驱动,负责任务调度、上下文维护和状态监控。

  • 执行模块像四肢,通过 Python、命令行脚本、MCP 服务、Function Calling、本地 API 或 SDK 等方式完成任务。

  • 通信和交互模块像五官,接入微信、飞书、本地 WebUI 等入口,并逐渐走向多模态交互,不再只依赖键盘和鼠标。

  • 记忆模块则像人脑记忆体,负责存储用户偏好、历史任务和关键上下文。

在常见执行流中,用户通过微信、飞书或本地 WebUI 提交需求,消息网关将需求拆解并封装成系统提示词,交给云端 AI 模型推理。模型完成任务分解后,再通过不同执行器调用工具执行。执行结果会再次交给大模型分析,判断任务完成度,并规划下一步动作。这个过程会循环往复,直到任务完成。

必要时,系统还会调用 Skill。Skill 可以理解为大模型的“指南”和“说明书”,帮助模型在特定任务中更稳定、更符合预期。如果任务中产生了关键信息,也会通过记忆模块持久化保存。这基本是目前 OpenClaw 等智能体系统的共同运行逻辑。

为什么必须端云混合?

答案很简单:云端太贵,本地还不够聪明

云端 AI 能力更强,支持更长上下文,也更适合复杂推理任务。但它的问题也明显:成本高、存在隐私顾虑,而且在 Token 经济火热之后,云端 AI 能力和响应速度并不总是稳定。

端侧 AI 可以降低 Token 消耗,也能减少隐私数据外发,适合处理固定流程、本地文件、语音转文字、OCR 等任务。但端侧模型智能水平仍然和云端大模型有差距。即便把 120B 模型通过量化方式强行跑在端侧设备上,在任务完成度和质量上,仍然难以完全追上云端更大规模模型,而且硬件成本也高,特别是在内存价格高企的背景下并不适合普及。

因此,英特尔认为正确方向不是端侧替代云端,也不是所有任务都上云,而是端云协同。

更具体地说,智能体 PC 需要一个本地“辅脑”。它可以是运行在 AI PC 本地的中小尺寸模型,用来分担云端“主脑”的一部分推理工作。相对固定、不容易出错、隐私敏感或低延时要求高的任务,可以交给本地辅脑完成;复杂推理和长上下文任务,再交给云端主脑。

本地辅脑不只是跑一个小语言模型,还可以承担大量专项 AI 任务。例如,当智能体需要执行语音转文字任务时,可以调用本地 ASR 模型,而不必再把音频传到云端。这样既降低费用,也减少延时。

同时,系统还需要任务路由机制,由智能决策器判断任务类型,决定调用云端主脑还是本地辅脑。

英特尔希望,通过这套机制,未来至少 30%以上的任务可以放在本地运行,从而同时提升可靠性并节省 Token 费用。

英特尔给出三档智能体 PC 硬件路线

要让智能体 PC 从极客玩具变成大众工具,硬件价格和形态必须足够现实。英特尔给出的方案,是用不同 CPU 平台覆盖入门、主流和旗舰三档市场。

  • 第一档是第三代英特尔酷睿处理器 Wildcat Lake 平台,面向入门市场,提供 40 TOPS 算力,可满足部分本地 AI 需求。英特尔将其定位为智能体 PC 的入门 CPU 选择。

  • 第二档是第三代英特尔酷睿 Ultra 处理器 Panther Lake 家族,分为 8 核和 16 核版本。其中 8 核产品可提供最高 100 TOPS 算力,已经可以在本地运行 Qwen3.5、Qwen3.6 家族中的部分模型,承担本地辅脑能力。

  • 第三档是旗舰酷睿 Ultra X 系列,采用 12 Xe CPU 设计,AI 算力可达 180 TOPS。英特尔认为,这一平台可以在端侧胜任 35B MoE 模型,并提供更好的 Token 速度和用户体验。

在内存配置上,英特尔认为 32GB 是相对合理的主流选择,经济条件允许则可以选择 64GB。得益于统一内存架构和灵活可调显存技术,32GB 系统中最高可将 92%以上内存分配给显存,约 27GB 可作为显存使用,足以全量载入 35B 模型,并实现 128K 以上上下文窗口。入门配置则可以使用 16GB,甚至 12GB 内存,用于运行中小尺寸模型,以降低成本和功耗。

MoE 模型的特点是拥有多个专家,但不同专家被激活的概率并不相同,经常会出现“热专家”和“冷专家”。英特尔强调了 AI SSD 技术的思路,即把不常使用的冷专家卸载到 SSD 中,需要时再从 SSD 动态加载。这对 SSD 性能提出了很高要求,包括顺序读写、随机读写以及软件优化。这类技术的意义在于,让更大模型有机会在成本更可控的端侧设备上运行,而不是全部依赖昂贵内存。

据悉,当前英特尔与合作伙伴群联已经实现 AI SSD 针对第三代英特尔酷睿 Ultra 系列处理器的卸载和加速。

在产品形态上,英特尔认为 Mini PC 是智能体 PC 的一个好形态,但绝不是唯一形态。轻薄笔记本会是智能体 PC 最重要的大众化载体,因为它离普通用户最近,也最容易普及。除此之外,一体机、AI NAS、AI Box、边缘网关,甚至其他系统集成设备,都可能成为智能体 PC 的不同形态。