惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Latest news
Latest news
T
Troy Hunt's Blog
V
Vulnerabilities – Threatpost
L
LINUX DO - 热门话题
cs.CL updates on arXiv.org
cs.CL updates on arXiv.org
Simon Willison's Weblog
Simon Willison's Weblog
V
V2EX
博客园 - 司徒正美
B
Blog RSS Feed
AWS News Blog
AWS News Blog
MyScale Blog
MyScale Blog
Scott Helme
Scott Helme
Cisco Talos Blog
Cisco Talos Blog
Last Week in AI
Last Week in AI
NISL@THU
NISL@THU
博客园 - Franky
P
Proofpoint News Feed
博客园_首页
C
CERT Recently Published Vulnerability Notes
雷峰网
雷峰网
S
Schneier on Security
P
Proofpoint News Feed
Hugging Face - Blog
Hugging Face - Blog
G
GRAHAM CLULEY
博客园 - 三生石上(FineUI控件)
月光博客
月光博客
WordPress大学
WordPress大学
The Hacker News
The Hacker News
T
Threatpost
阮一峰的网络日志
阮一峰的网络日志
A
Arctic Wolf
Microsoft Azure Blog
Microsoft Azure Blog
T
The Exploit Database - CXSecurity.com
Engineering at Meta
Engineering at Meta
罗磊的独立博客
T
The Blog of Author Tim Ferriss
D
Darknet – Hacking Tools, Hacker News & Cyber Security
I
Intezer
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
K
Kaspersky official blog
SecWiki News
SecWiki News
云风的 BLOG
云风的 BLOG
美团技术团队
C
Cybersecurity and Infrastructure Security Agency CISA
博客园 - 【当耐特】
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Security Latest
Security Latest
C
Cyber Attacks, Cyber Crime and Cyber Security
B
Blog
S
Security Affairs

������������Ƶ��

以工业规模创造智能 NVIDIA GTC 2022发布众多产品组合-芯片-计算频道-至顶网 让数据传输更快、更安全 Rambus PCIe 6.0控制器创新看得见-芯片-计算频道-至顶网 英伟达扩展Omniverse生态系统 为设计师打造数字孪生能力-系统软件-计算频道-至顶网 Nvidia升级AI软件平台提升语音、推荐系统和推理能力-系统软件-计算频道-至顶网 IPF2022 | 打铁还需自身硬 英信未来携手浪潮信息打造能力升级之路-服务器-计算频道-至顶网 IPF2022 | 德康世纪李国伟:智慧算力是数实相融时代的重要资产-服务器-计算频道-至顶网 短评:IBM大中华区总经理迎来新人选——陈旭东-服务器-计算频道-至顶网 英特尔:将通过订阅模式扩大软件收入 2022年有望增至1.5亿美元-芯片-计算频道-至顶网 英特尔:将在未来几周内发布第三代Optane-芯片-计算频道-至顶网 IPF2022 | 两成收入带来五成利润 南京创瑞丰开启分销增长“新模式”-服务器-计算频道-至顶网 在这个充满变数的数字世界,连接力就是头号生产力-芯片-计算频道-至顶网 见招拆招 英特尔、HPE专家为您解答IT转型的四大典型问题-服务器-计算频道-至顶网 新硅光子技术广受好评,GlobalFoundries获得厂商支持-芯片-计算频道-至顶网 Nvidia宣布收购软件定义块存储公司Excelero-系统软件-计算频道-至顶网 英特尔AMD等科技巨头宣布联合制定小芯片技术行业标准-芯片-计算频道-至顶网 可编程硬件和开放式软件 英特尔驱动网络与边缘创新的新时代-芯片-计算频道-至顶网 VMware发布第四季度财报 向订阅和SaaS收入模式转型任重道远-系统软件-计算频道-至顶网 戴尔发布第四季度财报 全年收入突破1000亿美金-服务器-计算频道-至顶网 HPE与芯片初创公司Ayar Labs合作 推进超级计算机硅光子研究及商业化-芯片-计算频道-至顶网 英特尔即将推出面向5G网络和数据中心的新款至强芯片-芯片-计算频道-至顶网 Rackspace发布第四季度和全年财报 核心云服务业务增长稳健-数据中心-计算频道-至顶网 英特尔发布至强路线图:核心更多、晶体管密度更高-芯片-计算频道-至顶网 英特尔更新芯片路线图 预览多款GPU芯片及制程工艺改进-芯片-计算频道-至顶网 大手笔收购:可编程逻辑与赛灵思IP在AMD麾下如何立功?-芯片-计算频道-至顶网 Nvidia发布第四季度抢眼财报 数据中心业务大涨71%-芯片-计算频道-至顶网 英特尔收购Tower Semi成为端到端代工厂:未来会分拆IFS吗?-芯片-计算频道-至顶网 打开元宇宙的“大门” 脑机接口让你在现实与梦境之间自由穿梭-芯片-计算频道-至顶网 英特尔计划对x86开放Arm、RISC-V等多架构协同许可-芯片-计算频道-至顶网 赋能碳中和 青云打造技术驱动的双碳智慧建筑解决方案-数据中心-计算频道-至顶网
英伟达重磅发布性能最高的下一代H100 GPU芯片-芯片-计算频道-至顶网
2022-03-23 · via ������������Ƶ��

在今天举行的2022 GPU Technology Conference大会上,英伟达宣布推出了强大的下一代GPU。

新款GPU基于Nvidia Hopper架构(如图),英伟达承诺该芯片与两年前推出的上一代Ampere芯片相比,性能提升了一个数量级。

英伟达重磅发布性能最高的下一代H100 GPU芯片

第一款基于Hopper架构的GPU是Nvidia H100,一个强大的加速器,包含了800亿个晶体管和多项新功能,其中有Transformer Engine以及可扩展性更高的Nvidia NVLink互连功能,用于提升大型AI语言模型、深度推荐系统等等。

英伟达表示,H100 GPU非常强大,只需20个这样的GPU就可以承载全球所有互联网流量,这也让H100成为那些最先进的AI工作负载的理想选择,例如数据实时推理等。同时,这也是首款支持PCIe Gen5和使用HBM3的GPU,后者意味着H100拥有超过3TB的内存带宽。

重要的是,英伟达H100 GPU更新采用了新的Transformer Engine,可以将基于Transformer的自然语言处理模型速度提高到是上一代A100 GPU的6倍。其他改进还包括第二代安全多实例GPU技术,可将单个H100芯片划分为7个更小的、完全隔离的实例,也就意味着可以同时处理多个工作负载。

H100同时也是第一款拥有机密计算能力的GPU,可在AI模型及其运行时保护它们的数据。此外,H100拥有新的DPX指令,可以实现加速动态编程,一种在很多优化、数据处理和组学算法中常用的技术,英伟达称,其速度是现有最先进的CPU的40倍。因此,H100芯片可以用于加速自主机器人编队使用的Floyd-Warshall算法,或者用于DNA和蛋白质分类序列比对的Smith-Waterman算法。

英伟达表示,H100 GPU旨在为使用大规模AI模型的沉浸式实时应用提供动力,让更高级的聊天机器人能够使用有史以来最为强大的单片变压器语言模型——Megatraon 530B,且吞吐量比A100 GPU高出30倍。英伟达承诺,该芯片还能让研究人员更快速地训练其他大型AI模型。

英伟达表示,除了为AI模型提供动力之外,H100 GPU还将在机器人、医疗、量子计算和数据科学等领域带来重大影响。

H100将于第三季度上市,届时客户将有一系列可用的选项,例如英伟达表示,第四代DGX 系统DGX H100将包含8个H100 GPU,最高可以实现32 petaflops的AI性能。H100芯片也将通过云服务厂商提供,包括AWS、Google Cloud、微软Azure、Oracle Cloud、阿里云、百度AI云和腾讯云,所有这些厂商都计划提供基于H100的实例。

此外,戴尔、HPE、思科、Atos、联想等厂商还将提供一系列采用H100的服务器产品。

除了H100 GPU之外,英伟达还推出了首款基于Arm Neoverse的离散数据中心CPU,专为针对AI基础设施和高性能计算而设计。

这款名为Nvidia Grace CPU Superchip的CPU,包含了2个通过NVLink-C2C(一种新的高速和低延迟芯片到芯片互连技术)连接的CPU,是对英伟达去年推出的首款CPU-GPU整合模块Hopper Superchip的一个补充。Nvidia Grace CPU Superchip将144个Arm核心打包在一个插槽中,支持Arm新一代矢量扩展和英伟达所有计算软件堆栈,包括Nvidia RTX、Nvidia HPC、Nvidia AI和Omniverse。

这些芯片也将于第三季度推出,届时将为那些要求最为苛刻的高性能计算、人工智能、数据分析、科学计算和超大规模计算应用提供所需的性能。