


























2026年6月24日,OpenAI与博通(Broadcom)联合发布了名为Jalapeño的推理加速芯片,这是OpenAI的首颗自研芯片,专为大语言模型推理场景从零设计。该芯片的工程样片已在实验室中以目标频率和功耗运行机器学习负载,包括GPT-5.3-Codex-Spark模型。 https://openai.com/index/openai-broadcom-jalapeno-inference-chip/ 早期测试数据显示,Jalapeño的每瓦性能将大幅优于当前行业最高水平,详细技术报告将在未来数月内公布。架构层面,该芯片通过减少数据搬运、平衡计算-存储-网络资源配比,使实际利用率更接近理论峰值——这是当前主流通用加速器普遍存在的短板。OpenAI强调,Jalapeño并非通用GPU的改良品,而是围绕其在ChatGPT、Codex、API及未来智能体产品中积累的实际服务模式,对芯片架构、内核、内存系统、调度与部署进行全栈协同设计的产物。 该芯片从初始设计到制造流片仅耗时九个月,OpenAI称这是高性能先进半导体领域有史以来最快的ASIC开发周期,其中OpenAI自身的模型被...
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。