惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

大猫的无限游戏
大猫的无限游戏
Webroot Blog
Webroot Blog
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
T
Threat Research - Cisco Blogs
V2EX - 技术
V2EX - 技术
L
LINUX DO - 热门话题
Google DeepMind News
Google DeepMind News
Recorded Future
Recorded Future
S
Schneier on Security
I
InfoQ
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
The GitHub Blog
The GitHub Blog
S
Security @ Cisco Blogs
O
OpenAI News
W
WeLiveSecurity
Vercel News
Vercel News
阮一峰的网络日志
阮一峰的网络日志
Simon Willison's Weblog
Simon Willison's Weblog
人人都是产品经理
人人都是产品经理
Cloudbric
Cloudbric
The Last Watchdog
The Last Watchdog
The Hacker News
The Hacker News
Google Online Security Blog
Google Online Security Blog
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
GbyAI
GbyAI
NISL@THU
NISL@THU
T
Tailwind CSS Blog
V
Visual Studio Blog
PCI Perspectives
PCI Perspectives
K
KPMG report finds enterprise disconnect between AI and its ROI | CIO
Jina AI
Jina AI
D
DataBreaches.Net
B
Blog RSS Feed
N
News and Events Feed by Topic
N
News and Events Feed by Topic
H
Heimdal Security Blog
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
腾讯CDC
Latest news
Latest news
V
Vulnerabilities – Threatpost
Hacker News: Ask HN
Hacker News: Ask HN
WordPress大学
WordPress大学
V
V2EX
aimingoo的专栏
aimingoo的专栏
博客园 - 司徒正美
Apple Machine Learning Research
Apple Machine Learning Research
D
Darknet – Hacking Tools, Hacker News & Cyber Security
The Register - Security
The Register - Security
Help Net Security
Help Net Security

InfoQ - 促进软件开发领域知识与创新的传播

Meta 收购 Manus 这事儿泡汤了 5.5万 Star 开源项目 Ghostty 被迫出走,GitHub 正在终结一代技术人的乌托邦 谷歌开源“Agent Skill 超级工具箱”,云、库、引擎、AI全线打通,开发者狂喜 Slack 长时运行多智能体系统的上下文管理方案 从 T+1 到分钟级:金城银行基于 Apache Doris 构建高可靠、强一致的实时数据平台 谷歌云推出 Agents CLI,简化 AI 智能体开发全流程 Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了 亚马逊云科技终止 WorkMail 服务,并将 App Runner 转入维护模式 OPPO小布记忆:全模态碎片化内容的理解与智能整理实践|AICon上海 模力工场038周AI应用周榜:工具在消失,工作流在出现 Akamai CEO Tom Leighton:Agent 时代来临,云基础设施正从“中心化”转向“分布式边缘” 日均数百亿入库背后:从“人肉调度”到K8s弹性架构,度小满金融基于OceanBase重构入库架构实践 百度文库网盘发布GenFlow 4.0:月活用户超1亿,要把网盘变成全端AI工作台 Altman 投的 Agent 终端 Warp 开源了!斩获3.5万star 哪些客户需要拒, 敢让龙虾决定吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从开发到生产:为什么越来越多的机器学习团队纷纷迁移到 Snowflake | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 探索多智能体工作流:LangGraph Snowflake Cortex AI | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 腾讯云分布式缓存数据库:AI Agent - 从提示词工程到 Harness 工程 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 基于 Streamlit 为 CSV 数据构建分析智能体 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 AI 智能体:告别文档缺漏 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 构建 AI 驱动的数据管道:深度探讨 Snowflake Openflow 与非结构化数据 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 云端太贵、本地不够聪明,英特尔押注“端云混合AI”:智能体PC会替人完成工作 不到10%的存储投入,可能拖垮90%的GPU投资!IBM把AI Agent塞进存储系统,算清企业最容易忽略的一笔账 Snowpark 上手实战 | BUILD 2025_大数据_王玮_InfoQ精选视频 ClickHouse + Langfuse,构建 Agent 可观测基石 腾讯云分布式缓存数据库:Cluster Proxy 共享连接架构深度解析 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 AI 写代码太烧钱了:Copilot、Claude 一起涨价,不如把程序员请回来? 腾讯云分布式缓存数据库:从 Redis 到 Valkey - 开源社区如何快速创新 | 腾讯云数据库 DBTalk_腾讯_凌敏_InfoQ精选视频 印奇这次要“从0重做”智驾模型!首谈阶跃和千里双公司布局:中国AI商业闭环要靠车跑出来 从Cursor返聘归来,90后华裔女高管带Claude开启日更模式:token成本比工程师工资低多了! 从 Coding 到 Agent:QCon 北京 2026 全景复盘,优秀出品人 & 明星讲师名单揭晓 全链路支撑大模型国产化“Day 0适配”,商汤大装置构建全栈能力底座 凌晨,OpenAI 与亚马逊云科技史上最大联合发布来了 HashiCorp Vault 2.0 发布:引入新身份联邦机制,迈入 IBM 生命周期体系 Yelp 实现超 1,000 个 Cassandra 节点零停机升级 写了 17 年开源代码,我为什么认为 Coding Agents 堆功能是在瞎折腾? 基于 Apache Camel 编排智能体与多模态 AI 管道 面向智能体与人类用户的AI记忆系统:架构设计与核心场景实践|AICon上海 Anthropic 推出 Managed Agents,简化 AI 代理部署流程 阿里HappyHorse开启灰测,720P视频生成低至0.44元/秒 讯飞联合清华团队押注量子AI:不看营收、不设KPI,一群“无人区”科学家,抢夺下代AI算力入口 小米万亿模型全面开源:MIT 协议、1M 上下文,但还是打不过 DeepSeek Cortex Code 入门指南:面向数据工程师的实践路径 | 技术实践 openJiuwen社区首发Team Skills,定义Coordination Engineering新范式 用 Snowflake Cortex Agents 释放结构化数据的最大价值 | 技术实践 Grafana 利用 Kafka 对 Loki 进行了架构重构,并发布了一款命令行工具,旨在将可观测性引入编码代理 ClickHouse重构全文索引:对象存储上跑出高性能 Full-Text Search 可观测性和遥测技术如何提升软件工程实践 Dropbox 与 GitHub 合作,将单体库大小从 87GB 缩减至 20GB Agent 的下一站:基于长期记忆系统 EverOS 的自我演进|AICon上海 同一赛道,四种收费:Agent 控制层(Harness)开始分裂 Cloudflare Sandboxes 正式发布,为 AI 代理提供持久化隔离环境 Agent 的“记忆断片”困局,该怎么破?_AI&大模型_AICon 全球人工智能开发与应用大会_InfoQ精选视频 数据分析师如何快速建立在 AI 时代最值钱的能力:一份可落地的行动路线图 摩尔线程最新财报:研发占比超86%,万卡级大规模智算集群落地 当云区域失效:地缘动荡环境下的高可用重构 Slack 重构通知系统,设置参与度提升 5 倍 智能体工程的隐性技术债务 “我把所有模型都换成了DeepSeek V4”:月账单将降 90%,效果还更好 阿里云智能集团高级技术专家刘少伟已确认出席AICon上海站,并分享如何构建企业 Agent 的自动化行动架构 构建生产就绪的 tRPC API:Apollo Federation 的 TypeScript 替代方案 Anthropic推出面向Claude Code的基于智能体的代码审查功能 北京车展直击:斑马智能甩出车载Agent短剧,比亚迪率先落地,AI让智能座舱又热起来了 Snowflake 作为智能体运行时:从静态管道迈向自主数据系统 | 技术实践 Snowflake 上的本体体系:基于 Cortex Code 能力实现从架构到部署 | 技术实践 Cloudflare 公布 MCP 架构方案,应对企业面临的安全与治理风险 复杂的项目管理怎么做到「AI 友好」?飞书项目用「开放」给出答案 Snowflake Cortex Code 的规范驱动开发:将 SDLC 方法论引入 AI 辅助工作流 | 技术实践 Copilot 不让注册了:从“随便用”到“全面限”,agent 把原有订价模型顶穿了 当互联网用AI卷效率时,这家公司先问了一连串“能不能” Meta 开始记录员工每一次点击:AI 要接管工作,先监控会工作的人 Meta“Token榜”逼疯打工人,一夜烧掉公司几万刀!AI时代Token焦虑越来越离谱 智源FlagOS完成DeepSeek-V4-Flash在八款芯片Day0适配,实现三重技术突破 DeepSeek V4 重磅开源!首次打通华为Ascend,也没丢掉英伟达,百万上下文夺回国产模型话语权 李志飞的“新实验”:当超级个体撞上真实组织 GPT-5.5 登顶时刻,Anthropic 亲口承认 Claude 变笨了!网友群嘲:太敷衍 那些没空写的小需求,龙虾真能做吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 从 Pandas 到生产:使用任意 IDE 进行可扩展的 ML 数据管道与分布式处理 | BUILD 2025_AI&大模型_王玮_InfoQ精选视频 pnpm 11 候选版本发布,带来 ESM 分发、供应链默认设置以及新的存储格式 银行业PDF表格提取方案重构:基于Java的分层方案 GPT-5.5 赢了 Opus 4.7 和 Mythos?奥特曼晒黄仁勋内部信:英伟达全员用上 Codex! Cloudflare 推出 Think:一款面向 AI 代理的持久化运行时 1850亿美元天价支出、75%代码由AI生成!谷歌正式宣告:全面转向智能体工作流 xAI落后太多,马斯克“开大”重金求购Cursor,100亿美金“分手费”都敢签! Pulumi 新增对 Bun 运行时的全面支持 姚顺雨腾讯模型首秀!不卷参数只做 “听话打工人”,Hy3 preview登场 | 附实测 老板让你“忽悠”投资人,你敢发给龙虾吗?_AI&大模型_InfoQ 中文站_InfoQ精选视频 Gemini CLI 引入子代理机制,实现任务委派与并行代理工作流 清华系团队星工聚将完成数千万天使轮融资,轮式机器人拿下头部制造企业亿级大单 Pretext.js 绕过 DOM 布局重排,实现 120 FPS 的高级交互体验 靠“AI 云”爆红的 Vercel,栽在一个第三方AI工具手里!IPO前夕遭黑,200万美元赎金谈崩? 高能研讨会|端侧 AI 正在重写实时感知效率上限_AI&大模型_王玮_InfoQ精选视频 2050大会看这篇就够了|报名、交通食宿指引大全 Java 近期资讯:OpenJDK JEP、Jakarta EE 12、Spring Framework、Micrometer、Camel、JBang 金融智能的架构编排:基于 Snowflake Cortex Agents 实现结构化与非结构化数据统一分析 | 技术实践 在AK大神爆火的任务里,摸清国产AI真实水平 百灵Ling-2.6-flash 正式发布:高 Token 效率,以 1/10 消耗实现 SOTA 级 Agent 能力 当 PM 懂AI,当技术懂产品:AI 时代产品力的双向进化|PM x AI产品力领航者大会即将开幕 为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体 获奖名单公布|2026主题征文第一期|分享你最有价值的龙虾场景与核心 Skill_热门活动_InfoQ写作社区官方_InfoQ写作社区
英特尔发布至强600系列工作站处理器与锐炫Pro B70 GPU,全新AI工作站来了
褚杏娟 · 2026-04-29 · via InfoQ - 促进软件开发领域知识与创新的传播

4 月 23 日,英特尔发布新一代 AI 工作站平台,推出了英特尔® 至强® 600 工作站处理器与英特尔锐炫™ Pro B70、B65 GPU。这次英特尔把重点放在了本地 AI 推理、企业智能体、AIGC 创作和部门级 AI 部署上。

至强 600:把数据中心级能力带到工作站

新发布的英特尔至强 600 工作站处理器,主要面向专业重负载场景,包括高性能工作站、AI 开发、边缘部署、内容生产和企业级应用。

从规格看,至强 600 最高配备 86 个性能核,多线程性能较上代最高提升 61%,睿频最高可达 4.8GHz。对于需要长时间高强度运行的工作站来说,多线程能力直接关系到工程仿真、渲染、编译、数据处理等任务的效率。

扩展能力也是这代平台的重点。至强 600 支持 128 条 PCIe 5.0 通道,配合芯片组后,可以为工作站带来更灵活的扩展空间。这意味着企业可以根据不同 AI 和专业负载需求,配置多卡 GPU、高速存储、网络设备或其他加速卡。

在 AI 能力上,至强 600 每个核心内置英特尔 AMX 引擎,并新增 FP16 原生支持。英特尔称,这使其 AI 和机器学习性能最高提升 17%;在图像降噪等典型影像处理场景中,速度可提升 4 到 5 倍。对于企业本地 AI 部署来说,这类能力可以降低对外部算力的依赖,也有助于控制总体拥有成本。

内存方面,至强 600 支持 8 通道内存,包括 RDIMM 6400 和 MRDIMM 8000 规格。其中,MRDIMM 通过内置 data buffer,可同时激活两个内存 Rank,将单次传输从 64B 提升到 128B,传输吞吐提升 2 倍,内存加载延迟降低 40%。

英特尔中国区技术部总经理高宇表示,今天很多 AI、数学计算和数据处理任务,瓶颈并不在计算本身,而是在内存吞吐,也就是所谓“内存墙”。MRDIMM 正是突破内存墙的一种手段,使至强 600 更适合 AI 大模型推理、高性能计算和大数据分析等对内存带宽要求高的场景。

此外,至强 600 还依托英特尔 vPro 技术体系,支持多种企业级管理特性,包括多密钥内存加密、一键恢复等功能,可适配塔式、机架式和边缘等多种部署形态。也就是说,它不只是面向单台高性能工作站,还试图覆盖企业批量部署和集中运维场景。

在工作站领域权威基准测试 Specworkstation 4.0 中,至强 600 在 5 个垂直行业实现最高 61%的性能提升。

英特尔至强 600 工作站处理器和英特尔锐炫 Pro B70/B65 显卡

锐炫 Pro B70/B65:瞄准本地 AI 推理、AIGC 和专业图形

GPU 侧,英特尔发布了锐炫 Pro B70 和 B65。其中,锐炫 Pro B70 基于第二代 Xe2 架构,面向图形渲染、通用并行计算和 AI 加速计算等专业负载。

B70 配备 32GB 显存,拥有 32 个 Xe 核心,AI 算力峰值达到 367 TOPS。英特尔强调,32GB 显存可以在 AI 推理场景中支持更大规模模型和更长上下文窗口。对于企业知识库、智能体、多轮问答、RAG 和行业模型推理来说,显存容量往往直接影响模型部署的可用范围。

在 Agentic 时代,长上下文变得尤其重要。英特尔认为,64K 上下文长度已经是完成 OpenClaw 类智能体对话的基础要求,而大显存正是支撑长上下文和高并发的关键。

在多用户并发场景中,B70 也被设计用于支持高吞吐量和快速响应,面向企业 AI 应用的本地部署。它支持 SR-IOV 虚拟化,并通过 50 余家 ISV 软件认证,可扩展多卡配置,同时配套 Linux 软件栈,包括 vLLM、oneAPI 和 PyTorch,以满足更多开发和部署需求。

同步推出的锐炫 Pro B65 同样搭载 32GB 显存,提供 197 TOPS AI 算力,为专业用户提供更灵活的选择。B70 更强调高性能 AI 推理和多用户并发,B65 则更适合对算力要求相对适中、但同样需要大显存的专业场景。

模型支持方面,B70 覆盖从 7B 到 100B 以上的模型,包括稠密模型、MoE LLM、多模态模型以及生图、生视频等 AIGC 模型。英特尔特别提到,针对国内流行的 Qwen3/3.5 家族,B70 已经支持 Qwen3-80B-Coder、Qwen3.5-122B 等模型。

结束语

IDC 数据显示,AI 驱动工作站正在呈现端侧 AI 算力快速增强、多元专业场景适配、端云协同联动和本地数据安全强化四大趋势。预计到 2026 年,中国 AI 工作站出货量将同比增长 65.2%,占整体工作站市场的 51.7%。

英特尔希望把 AI 工作站变成企业本地 AI 应用的入口。高宇表示,至强 600 工作站处理器与锐炫 Pro B70 共同为新一代 AI 工作站构筑了更完整的底座,可支撑智能体部署、大模型推理、内容创作和专业图形处理等场景。

英特尔市场营销集团副总裁、中国区总经理郭威表示,工作站正成为补齐 Agent 智能体与大模型落地的关键基石。

为此,英特尔提出了企业 AI 三层部署架构:中央级服务器集群提供规模化算力底座,个人级 AI PC 支撑轻量交互,而部门级 AI 工作站作为承上启下的核心枢纽,承载一线智能体与大模型推理,兼顾性能、成本与易用性。同时,工作站也是传统负载与 AI 融合的桥梁,能够在不改变用户习惯的前提下注入 AI 能力,实现传统业务与 AI 应用的无缝协同。

英特尔理念在实际业务中已有落地。比如,英特尔与火山引擎共同打造 AgentSphere 一体机联合方案。该方案基于至强 600 和锐炫 Pro B70 提供的本地算力与 32GB 显存,面向多智能体协同场景,强调更高并发、更低时延和更少抖动。标准一体机形态也降低了企业部署和维护门槛,帮助企业打造 AI 员工管理平台。

在智能办公场景中,联想智能会议系统 Lenovo SCH-900S 借助锐炫 Pro B70 的 32GB 显存和最高 367 TOPS AI 算力,实现多会议室并发接入和实时 AI 会议纪要生成,提升会议沟通和执行效率。