当前位置:

首页 > 业界资讯 > 最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

重新编写的内容如下:人工智能媒体报道为了保持原意不变,需要将原文内容改写成中文,不需要出现原句芯片巨头英伟达,又打出一张王牌。英伟达在2023年全球超算大会(SC2023)上发布了目前世界上最强的AI芯片H200。这款新的GPU是在H100的基础上进行了升级,内存带宽提高了1.4倍,内存容量提高了1.8倍,从而增强了处理生成式AI任务的能力。英伟达公司的高性能计算和超大规模数据中心业务副总裁IanBuck表示:“英伟达在硬件和软件方面的创新正在创造出新型AI超级计算机。”英伟达在其官方博客中表示,NVID

重新编写的内容如下:人工智能媒体报道

为了保持原意不变,需要将原文内容改写成中文,不需要出现原句

芯片巨头英伟达,又打出一张王牌。

英伟达在 2023 年全球超算大会(SC2023)上发布了目前世界上最强的 AI 芯片 H200。

这款新的GPU是在H100的基础上进行了升级,内存带宽提高了1.4倍,内存容量提高了1.8倍,从而增强了处理生成式AI任务的能力。英伟达公司的高性能计算和超大规模数据中心业务副总裁Ian Buck表示:“英伟达在硬件和软件方面的创新正在创造出新型AI超级计算机。”

英伟达在其官方博客中表示,NVIDIA H200 Tensor Core GPU 具备改变游戏规则的性能和内存功能,能够提升生成式人工智能和高性能计算工作负载的能力。作为首款采用HBM3e的GPU,H200利用更大更快的内存来加速生成式人工智能和大型语言模型的运行,并推动科学计算在高性能计算工作负载中的应用

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

除此之外,Buck还展示了一个服务器平台,该平台通过NVIDIA NVLink互连连接了四个NVIDIA GH200 Grace Hopper超级芯片。每个计算节点配备了多达288个Arm Neoverse内核和16 petaflops的AI性能,以及高达2.3 TB的高速内存

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

大模型推理加速 1.9 倍

NVIDIA H200 是基于 NVIDIA Hopper 架构的产品,它与 H100 相互兼容。这意味着那些已经使用过之前模型进行训练的人工智能公司,无需改变他们的服务器系统或软件,就可以直接使用这个新版本

H200 是一款 GPU,以 4.8 TB/s 的速度提供了 141 GB 的 HBM3e 内存,几乎是 NVIDIA H100 Tensor Core GPU 容量的两倍。H200 还配备了高达 141GB 的超大显存,与 H100 的 80GB 相比,容量几乎翻倍,并且带宽还增加了 2.4 倍

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

H200 更大更快的内存可加速生成式 AI 和 LLM 的运行,同时以更高的能源效率和更低的成本推进 HPC 工作负载的科学计算。

例如,在处理 Llama2 等 LLM 时,H200 的推理速度比 H100 GPU 提高了近 2 倍。

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

当使用GPT-3等模型时,NVIDIA H200 Tensor Core GPU的推理性能提高了18倍。此外,在其他生成式AI基准测试中,每秒可以处理12000个tokens的Llama2-13B

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

内存带宽对于 HPC 应用程序至关重要,因为它可以实现更快的数据传输,减少复杂的处理步骤。对于那些内存密集型 HPC 应用如模拟仿真、人工智能研究等,H200 更高的内存带宽可确保高效地访问和操作数据,与 CPU 相比,给出结果的时间最多可加快 110 倍。

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

随着H200的问世,能源效率和总拥有成本(TCO)迈上了全新的台阶

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

请看下图,这是 H200 的一些参数介绍:

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

英伟达表示,从明年开始,亚马逊网络服务、谷歌云、微软 Azure 和甲骨文云基础设施将成为首批部署基于 H200 实例的云服务提供商。

根据官方网站的信息显示,H200计划于2024年第二季度开始向全球的系统制造商和云服务提供商供货。不过,英伟达尚未透露H200的具体价格。CNBC的报道称,上一代的H100预计每台售价在2.5万美元至4万美元之间,需要数千台才能达到最高水平的运行

关于 H200 是否会像 H100 一样供应紧张,英伟达并未明确回答

在给 The Verge 的邮件中,英伟达发言人 Kristin Uchiyama 表示 H200 的亮相不会影响 H100 的生产:「你会看到我们全年的总体供应量有所增加,并且我们将继续长期购买供应。」

最新发布的超级计算机排名榜单 Top500 已经公布

上榜系统使用的英伟达 H100几乎全新

与此同时,SC23 大会还宣布了最新一期的超级计算机 TOP500 榜单。Frontier 系统仍然稳居榜首,仍然是唯一一个拥有百亿亿次计算能力的计算机,但是前十名的排名已经因为五个新系统或升级系统的加入而发生改变

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

榜单地址:https://www.top500.org/lists/top500/2023/11/

在最新的排行榜中,使用英伟达技术的超级计算机数量达到了历史最高水平,总共有379台,其中包括了新上榜的49台超级计算机中的38台。与今年5月份相比,这一数字增加了7台

英伟达为这些系统提供了超过2.5 exaflops的高性能计算性能,比5月份的1.6 exaflops高。在前10名中,英伟达贡献了近1 exaflops的高性能计算性能和72 exaflops的AI性能

比如,微软 Azure 的 Eagle 系统在 NDv5 实例中使用了 H100 GPU,以 561 petaflops 的成绩位列第 3,在新上榜的超级计算机中遥遥领先,巴塞罗那的 Mare Nostrum5 排名第 8,英伟达 Eos(最近在 MLPerf 基准测试中创造了新的 AI 训练记录)排名第 9。

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

基于强大的性能,英伟达未来将为世界各地的超算中心提供更好的算力服务。就在 SC23 大会上,多家超算中心宣布了正在为自己的超算集成 GH200 系统。

举例来说,德国尤利希超算中心计划在「木星」(JUPITER)上运用GH200超级芯片,这将成为欧洲第一台拥有百亿亿次计算能力的超级计算机

最强AI芯片英伟达H200,Llama2-70B推理提速90%,2024年二季度发货

参考链接:

https://blogs.nvidia.com/blog/efficient-ai-supercomputers-sc23/

NVIDIA宣布了H200 AI GPU的规格和发布日期

本文内容来源于互联网,如有侵权请联系删除。
作者最新文章
业界资讯 AI芯片
相关文章 更多
英伟达推出NVHBM:定制HBM带宽提升30%并扩展NVLink Fusion生态
英伟达推出NVHBM:定制HBM带宽提升30%并扩展NVLink Fusion生态

英伟达发布定制HBM技术NVHBM,通过集成内存控制器至HBM基础裸片,实现带宽较HBM4E提升30%、功耗降低15%,并释放主芯片25%空间。亚马逊Annapurna Labs为首个合作伙伴,该技术旨在通过标准化方案加速定制AI芯片开发,而非取代通用HBM。

英伟达 RTX PRO 6000 Blackwell 全线涨价 较去年首发价高出 55%
英伟达 RTX PRO 6000 Blackwell 全线涨价 较去年首发价高出 55%

英伟达RTXPRO6000Blackwell官方标价升至13250美元,较首发价8565美元上涨55%。受显存市场紧绷及AI需求升温影响,专业显卡价格持续走高,折射出高端GPU市场供需格局演变。

英伟达未发布的 RTX 2080 Ti SUPER 显卡首次曝光:拥有 4608 个 CUDA 核心与 12GB 显存 规格直逼 Titan RTX
英伟达未发布的 RTX 2080 Ti SUPER 显卡首次曝光:拥有 4608 个 CUDA 核心与 12GB 显存 规格直逼 Titan RTX

英伟达未发布的RTX2080TiSUPER工程样品现身eBay,配备4608个CUDA核心、12GB显存及384-bit位宽,规格接近TitanRTX。该卡因性能与定价内斗被取消,需在测试模式下修改驱动方可使用。

剑指英伟达!报道:亚马逊洽谈向其他公司出售自研AI芯片
剑指英伟达!报道:亚马逊洽谈向其他公司出售自研AI芯片

亚马逊计划将自研AI芯片Trainium对外销售,直接挑战英伟达市场主导地位。第三代芯片已售罄,第四代明年发布,累计收入承诺超2250亿美元。欧洲主权计算需求驱动战略转向,同时自研处理器Graviton已向Meta供应。

高管将访问英伟达总部讨论实体AI  LG旗下股票大涨
高管将访问英伟达总部讨论实体AI LG旗下股票大涨

近日,LG旗下多家子公司高管将集体访问英伟达总部,探讨实体人工智能与机器人领域合作。此前董事长已与黄仁勋会面。此消息推动LG电子、LGCNS等公司股价出现上涨。

诺基亚携手英伟达构建AI 6G网络,AI芯片从数据中心向电信基础设施渗透
诺基亚携手英伟达构建AI 6G网络,AI芯片从数据中心向电信基础设施渗透

诺基亚与英伟达合作开发AI6G网络,推动AI芯片从数据中心向电信基础设施渗透。6G算力需求增长,GPU等AI芯片成为核心组件,国产AI芯片企业迎来国产替代窗口,寒武纪、海光信息等持续突破。

高通宣布将向微软和Meta供货最新AI芯片
高通宣布将向微软和Meta供货最新AI芯片

近日,高通宣布微软和Meta将采用其人工智能芯片。微软选用基于平价内存的高带宽计算芯片,Meta选用自研处理器DragonflyC1000芯片。另有未具名云厂商正合作开发定制化芯片,意图冲击英伟达市场,挑战其主导地位。

高通将向微软和Meta供货最新AI芯片
高通将向微软和Meta供货最新AI芯片

高通公司向微软和Meta供应其最新一代AI芯片。微软采用了高带宽计算架构,使用了普通内存替代昂贵的HBM(高带宽内存);Meta则选用了自研CPUDragonflyC1000;此外还有两家尚未公开的超大规模云厂商正在等待其定制化芯片。

重磅!新思科技EDA+IP 硬核助力,瑞芯微打造业界首颗器人端侧AI芯片!
重磅!新思科技EDA+IP 硬核助力,瑞芯微打造业界首颗器人端侧AI芯片!

瑞芯微推出面向具身智能的旗舰AIoT芯片RK3588,采用新思科技全流程EDA工具与IP,实现高性能与低功耗突破。该芯片已在服务机器人、工业自动化等领域成功落地,推动端侧AI芯片创新,为具身智能提供强大算力支持。

英伟达统治超算榜单:TOP500占81%
英伟达统治超算榜单:TOP500占81%

英伟达在TOP500超算中占据81%份额,新上榜系统近90%采用其技术。AI训练吞吐量是其他平台总和两倍以上,推理吞吐量近三倍。Green500前八名均搭载英伟达GPU,GraceCPU系统增至26台,欧洲正开发35台英伟达AI超算。

查看更多
精品专题 更多
装机必备
装机必备

正软商城装机必备专区,精选办公、浏览器、安全防护、影音播放、压缩解压、设计创作和系统工具等电脑常用正版软件,帮助用户快速完成新电脑软件配置。

Windows
Windows

正软商城Windows软件专区,汇集适用于Windows电脑的办公、设计、安全防护、影音播放、开发工具和系统优化软件,提供软件介绍、系统要求、正版授权及购买下载服务。

macOS软件
macOS软件

正软商城macOS软件专区,精选适用于Mac电脑的办公、设计、影音、效率、开发和系统工具,提供软件功能介绍、macOS兼容版本、正版授权及购买下载服务。

Mac软件 更多
灵活计算器
灵活计算器
macOS/iOS/Android

灵活计算器是一款笔记式算数应用,支持实时计算、动态关联和云端同步功能。记录、整理和输出之间的过渡会更自然,适合长期写作、做笔记或持续沉淀个人内容。

赤友清理大师
赤友清理大师
macOS

赤友清理大师是一款为 Mac 设计的智能清理优化工具,可精准扫描垃圾、大文件、重复文件等,释放磁盘空间。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

WINDOWS 更多
Windows 10
Windows 10
Windows

Windows 10 是一款微软推出的经典操作系统,拥有硬件兼容性与多任务处理能力。它更偏向把系统状态查看和常用调节动作放在一起,适合需要持续观察和微调设备状态的场景。

极度公式
极度公式
Windows/macOS/Linux

极度公式是一款跨平台专业LaTeX公式识别编辑软件,支持OCR公式识别和多平台编辑。和使用说明,避免使用,享受完整功能与稳定支持。做扫描整理、文字提取和表格转换时,它能把识别后的处理步骤接得更顺,资料录入这类场景会省下不少时间。

密码键盘
密码键盘
Windows/macOS/iOS/Android

密码键盘是一款兼具安全性与便捷性的高效密码管理器。日常使用里的持续防护和信息管理会更突出,适合把安全控制放进长期使用流程中的场景。