惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

U
Unit 42
罗磊的独立博客
博客园 - 聂微东
T
The Blog of Author Tim Ferriss
博客园 - 司徒正美
Stack Overflow Blog
Stack Overflow Blog
F
Fortinet All Blogs
A
About on SuperTechFans
腾讯CDC
Apple Machine Learning Research
Apple Machine Learning Research
B
Blog RSS Feed
IT之家
IT之家
V
Visual Studio Blog
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
宝玉的分享
宝玉的分享
C
Check Point Blog
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
Vercel News
Vercel News
爱范儿
爱范儿
Microsoft Security Blog
Microsoft Security Blog
月光博客
月光博客
T
Tailwind CSS Blog
The Cloudflare Blog
Hugging Face - Blog
Hugging Face - Blog

OpenAI News

Using custom GPTs ChatGPT for customer success teams Applications of AI at OpenAI Research with ChatGPT Analyzing data with ChatGPT Financial services Responsible and safe use of AI Writing with ChatGPT ChatGPT for research Creating images with ChatGPT Personalizing ChatGPT ChatGPT for finance teams Getting started with ChatGPT Working with files in ChatGPT Learn ChatGPT workflows for sales teams Prompting fundamentals ChatGPT for managers Using projects in ChatGPT Learn ChatGPT workflows for marketing teams Brainstorming with ChatGPT AI fundamentals ChatGPT for operations teams Healthcare Our response to the Axios developer tool compromise Using skills CyberAgent moves faster with ChatGPT Enterprise and Codex The next phase of enterprise AI 儿童安全蓝图正式发布 推出 OpenAI 安全研究员计划 智能时代的产业政策
OpenAI 与 Cerebras 达成合作
2026-01-14 · via OpenAI News

Cerebras 打造专为 AI 设计的定制化系统,用于加速 AI 模型的长文本生成。其独特的速度源于将海量计算单元、内存与带宽集成于单一巨型芯片,从而消除了传统硬件上制约推理速度的瓶颈。

将 Cerebras 纳入我们的计算解决方案组合,核心目标就是让我们的 AI 响应更快。当您提出复杂问题、生成代码、创作图像或运行AI智能体时,幕后都在进行一个循环:您发送请求,模型思考,然后返回结果。当 AI 能够实时响应时,用户便能完成更多任务、停留更长时间,并运行价值更高的工作负载。

我们将分阶段把这项低延迟能力整合至我们的推理基础设施中,并逐步扩展至各类工作负载。

OpenAI 的 Sachin Katti 表示,“OpenAI 的计算策略是构建具有弹性的算力组合,为不同工作负载匹配最合适的系统。Cerebras 为我们的平台增添了一个专用的低延迟推理解决方案。这意味着更快的响应、更自然的交互,以及为向更广泛人群扩展实时AI能力奠定了更坚实的基础。”

Cerebras 联合创始人兼首席执行官 Andrew Feldman 表示,“我们非常高兴能与 OpenAI 合作,将全球领先的 AI 模型引入全球最快的 AI 处理器平台。正如宽带技术变革了互联网,实时推理也将变革 AI,催生构建 AI 模型及与之交互的全新方式。”

这部分计算能力将在 2028 年之前分批次陆续上线。