国际科技财经博客移民网络热点娱乐民生时事公众号

>

英伟达新核弹B200发布，一台服务器顶一个超算，万亿参数大模型30倍推理加速｜亮马桥小纪严选

英伟达新核弹B200发布，一台服务器顶一个超算，万亿参数大模型30倍推理加速｜亮马桥小纪严选

公众号新闻

2024-03-19 02:03

小纪有话说：

今天凌晨，AI春晚GTC开幕，皮衣老黄再次燃爆全场。

时隔两年，英伟达官宣新一代Blackwell架构，定位直指“新工业革命的引擎” ，“把AI扩展到万亿参数”。

作为架构更新大年，本次大会亮点颇多：

宣布GPU新核弹B200，超级芯片GB200
Blackwell架构新服务器，一个机柜顶一个超算
推出AI推理微服务NIM，要做世界AI的入口
新光刻技术cuLitho进驻台积电，改进产能。
……

8年时间，AI算力已增长1000倍。老黄断言“加速计算到达了临界点，通用计算已经过时了”。

老黄这次主题演讲题目为《见证AI的变革时刻》，但不得不说，英伟达才是最大的变革本革。

凌晨的GTC到底都讲了些什么？让我们一起来看看！

来源：量子位 | 公众号 QbitAI

梦晨克雷西发自凹非寺

GPU的形态已彻底改变

我们需要更大的GPU，如果不能更大，就把更多GPU组合在一起，变成更大的虚拟GPU。

Blackwell新架构硬件产品线都围绕这一句话展开。

通过芯片，与芯片间的连接技术，一步步构建出大型AI超算集群。

4nm制程达到瓶颈，就把两个芯片合在一起，以10TB每秒的满血带宽互联，组成B200 GPU，总计包含2080亿晶体管。

没错，B100型号被跳过了，直接发布的首个GPU就是B200。

两个B200 GPU与Grace CPU结合就成为GB200超级芯片，通过900GB/s的超低功耗NVLink芯片间互连技术连接在一起。

两个超级芯片装到主板上，成为一个Blackwell计算节点。

18个这样的计算节点共有36CPU+72GPU，组成更大的“虚拟GPU”。

它们之间由今天宣布的NVIDIA Quantum-X800 InfiniBand和Spectrum™-X800以太网平台连接，可提供速度高达800Gb/s的网络。

在NVLink Switch支持下，最终成为“新一代计算单元”GB200 NVL72。

一个像这样的“计算单元”机柜，FP8精度的训练算力就高达720PFlops，直逼H100时代一个DGX SuperPod超级计算机集群（1000 PFlops）。

与相同数量的72个H100相比，GB200 NVL72对于大模型推理性能提升高达30倍，成本和能耗降低高达25倍。

把GB200 NVL72当做单个GPU使用，具有1.4EFlops的AI推理算力和30TB高速内存。

再用Quantum InfiniBand交换机连接，配合散热系统组成新一代DGX SuperPod集群。

DGX GB200 SuperPod采用新型高效液冷机架规模架构，标准配置可在FP4精度下提供11.5 Exaflops算力和240TB高速内存。

此外还支持增加额外的机架扩展性能。

最终成为包含32000 GPU的分布式超算集群。

老黄直言，“英伟达DGX AI超级计算机，就是AI工业革命的工厂”。

将提供无与伦比的规模、可靠性，具有智能管理和全栈弹性，以确保不断地使用。

在演讲中，老黄还特别提到2016年赠送OpenAI的DGX-1，那也是史上第一次8块GPU连在一起组成一个超级计算机。

从此之后便开启了训练最大模型所需算力每6个月翻一倍的增长之路。

GPU新核弹GB200

过去，在90天内训练一个1.8万亿参数的MoE架构GPT模型，需要8000个Hopper架构GPU，15兆瓦功率。

如今，同样给90天时间，在Blackwell架构下只需要2000个GPU，以及1/4的能源消耗。

在标准的1750亿参数GPT-3基准测试中，GB200的性能是H100的7倍，提供的训练算力是H100的4倍。

Blackwell架构除了芯片本身外，还包含多项重大革新：

第二代Transformer引擎

动态为神经网络中的每个神经元启用FP6和FP4精度支持。

第五代NVLink高速互联

为每个GPU 提供了1.8TB/s双向吞吐量，确保多达576个GPU之间的无缝高速通信。

Ras Engine（可靠性、可用性和可维护性引擎）

基于AI的预防性维护来运行诊断和预测可靠性问题。

Secure AI

先进的加密计算功能，在不影响性能的情况下保护AI模型和客户数据，对于医疗保健和金融服务等隐私敏感行业至关重要。

专用解压缩引擎

支持最新格式，加速数据库查询，以提供数据分析和数据科学的最高性能。

在这些技术支持下，一个GB200 NVL72就最高支持27万亿参数的模型。

而GPT-4根据泄露数据，也不过只有1.7万亿参数。

英伟达要做世界AI的入口

老黄官宣ai.nvidia.com页面，要做世界AI的入口。

任何人都可以通过易于使用的用户界面体验各种AI模型和应用。

同时，企业使用这些服务在自己的平台上创建和部署自定义应用，同时保留对其知识产权的完全所有权和控制权。

这上面的应用都由英伟达全新推出的AI推理微服务NIM支持，可对来自英伟达及合作伙伴的数十个AI模型进行优化推理。

此外，英伟达自己的开发套件、软件库和工具包都可以作为NVIDIA CUDA-X™微服务访问，用于检索增强生成 (RAG)、护栏、数据处理、HPC 等。

比如通过这些微服务，可以轻松构建基于大模型和向量数据库的ChatPDF产品，甚至智能体Agent应用。

NIM微服务定价非常直观，“一个GPU一小时一美元”，或年付打五折，一个GPU一年4500美元。

从此，英伟达NIM和CUDA做为中间枢纽，连接了百万开发者与上亿GPU芯片。

什么概念？

老黄晒出AI界“最强朋友圈”，包括亚马逊、迪士尼、三星等大型企业，都已成为英伟达合作伙伴。

最后总结一下，与往年相比英伟达2024年战略更聚焦AI，而且产品更有针对性。

比如第五代NVLink还特意为MoE架构大模型优化通讯瓶颈。

新的芯片和软件服务，都在不断的强调推理算力，要进一步打开AI应用部署市场。

当然作为算力之王，AI并不是英伟达的全部。

这次大会上，还特别宣布了与苹果在Vision Pro方面的合作，让开发者在工业元宇宙里搞空间计算。

此前推出的新光刻技术cuLitho软件库也有了新进展，被台积电和新思科技采用，把触手伸向更上游的芯片制造商。

当然也少不了生物医疗、工业元宇宙、机器人汽车的新成果。

以及布局下一轮计算变革的前沿领域，英伟达推出云量子计算机模拟微服务，让全球科学家都能充分利用量子计算的力量，将自己的想法变成现实。

One More Thing

去年GTC大会上，老黄与OpenAI首席科学家Ilya Sutskever的炉边对谈，仍为人津津乐道。

当时世界还没完全从ChatGPT的震撼中清醒过来，OpenAI是整个行业绝对的主角。

如今Ilya不知踪影，OpenAI的市场统治力也开始松动。在这个节骨眼上，有资格与老黄对谈的人换成了8位——

Transformer八子，开山论文《Attention is all you need》的八位作者。

他们已经悉数离开谷歌，其中一位加入OpenAI，另外7位投身AI创业，有模型层也有应用层，有toB也有toC。

这八位传奇人物既象征着大模型技术真正的起源，又代表着现在百花齐放的AI产业图景。在这样的格局中，OpenAI不过是其中一位玩家。

而就在两天后，老黄将把他们聚齐，在自己的主场。

要论在整个AI界的影响力、号召力，在这一刻，无论是“钢铁侠”马斯克还是“奥特曼”Sam Altman，恐怕都比不过眼前这位“皮衣客”黄仁勋。

……

最后，再来欣赏一段英伟达为Blackwell架构制作的精彩动画短片。

直播回放：
https://www.youtube.com/watch?v=Y2F8yisiS6E

— 完 —

温馨提示：虽然我们每天都有推送，但最近有读者表示因平台推送规则调整，有时候看不到我们的文章~

欢迎大家进入公众号页面，右上角点击“设为星标”点亮⭐️，收藏我们的公众号，新鲜内容第一时间奉上！

*文章观点仅供参考，不代表本机构立场

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。

来源: qq

点击查看作者最近其他文章

相关阅读

支持百亿参数大模型、卢伟冰现场官宣小米首发，高通骁龙8s Gen3发布印度裔女博士造出会飞的电动船，马斯克抢着试驾｜亮马桥小纪严选波士顿动力Atlas，再见！退役视频引数十万观众泪目，液压退出历史舞台｜亮马桥小纪严选美股基本面 - 2024_01_19 * 晨报 * 贝莱德料美联储6月份开始降息欧洲央行紧随其后炒到 10 万元一台，苹果 Vision Pro 到底牛在哪里？｜亮马桥小纪严选来自科技进步一等奖的肯定：腾讯破解万亿参数大模型训练难题英伟达新核弹，站在苹果的肩膀上英伟达推「万亿参数」GPU，继续加速「AGI 时代」闷声造出75万大军，亚马逊正在悄悄撬动机器人商业化版图｜亮马桥小纪严选大模型又开“卷”！万亿参数闭源模型、四千亿开源模型来了微软拟与OpenAI投资1000亿美元建AI超算；Databricks 推出1320亿参数大语言模型 DBRX丨AIGC日报特斯拉机器人进厂打工，马斯克：手的自由度今年将达到22个！｜亮马桥小纪严选最强开源大模型 Llama 3震撼发布！开源模型将追上GPT-4，4000亿参数模型也在路上语言大模型推理加速指南号称中文评测超越 GPT-4，百川智能发布超千亿参数大模型 Baichuan 3 老黄祭出新核弹B200！30倍H100单机可训15个GPT-4模型，AI迎新摩尔时代 DIR (Floor Time)21世纪的美国女巫不写咒语，用SaaS疯狂赚钱｜亮马桥小纪严选不明白播客：大选前夜体验台湾民主的细节 2024巴菲特股东大会800字精华版来了（附全文）｜亮马桥小纪严选 OpenAI突破性发布GPT-4o！电影《她》真的来了｜亮马桥小纪严选 Social Thinking 全球最强大模型一夜易主，GPT-4时代终结！Claude 3提前狙击GPT-5，3秒读懂万字论文理解力接近人类｜亮马桥小纪严选消费电子通往AI时代的七种方式｜亮马桥小纪严选苹果iOS 18将搭载生成式AI；谷歌Bard最新排名超GPT-4；百川发超千亿参数大模型Baichuan 3丨AIGC大事日报 ABA - 放诸四海而皆准 ChatGPT创作小说获顶级文学奖！33岁女作家用AI写《东京共鸣塔》，评委无一人辨认｜亮马桥小纪严选脑机接口迎新突破，马斯克宣布人类首次植入脑机接口芯片｜亮马桥小纪严选北京算力基建实施方案重磅发布！重点支持采购自主可控GPU，要支撑万亿参数大模型训练 AI早知道｜360安全大模型3.0发布；通义听悟上线音视频问答助手；腾讯混元大模型参数规模扩展至万亿一年涨了 700 亿美金市值，奈飞怎么做到的？｜亮马桥小纪严选全球顶尖AI研究者中国贡献26%；1320亿参数大模型开源；Anthropic大模型测评首超GPT-4丨AIGC大事日报 Sora进驻Adobe视频编辑软件！新版Premiere Pro开启AI剪辑时代｜亮马桥小纪严选蒂姆·库克首次揭秘：我为什么「ALL IN」Vision Pro｜亮马桥小纪严选告别微软，姜大昕带领这支精英团队攀登Scaling Law，万亿参数模型已有预览版

热点事件追踪