现场直击GTC大会|黄仁勋与九个人形机器人同台,新一代平台推理能力提升30倍
2024-05-31 【 字体:大 中 小 】
美国当地时间3月18日下午,全球瞩目的英伟达2024GTC大会在加州圣何塞SAP球场开幕。英伟达创始人CEO黄仁勋在主题演讲开场时风趣地说道:“这不是演唱会,这是开发者大会,我们会谈论很多计算机科学的话题。”
当黄仁勋一身皮衣走向舞台时,观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。
“我们正在以从未有过的方式来创建软件。”黄仁勋在演讲中强调,“这就需要构建更大的GPU。”
黄仁勋演讲时,英伟达的股价没有太大变化,竞争对手AMD股价大跌超过3%。
在演讲结束时,黄仁勋与正在使用英伟达软硬件平台开发的九款人形机器人共同登台,还与两个该公司正在测试的小型机器人进行互动。

大模型推理性能可提升30倍
在整场发布会上,最受关注的是英伟达基于下一代计算架构Blackwell超级芯片而构建的AI超级计算机。黄仁勋曾在多个场合表示,英伟达已经成为了一家平台公司。
黄仁勋率先发布了一款搭载英伟达GB200 Grace Blackwell超级芯片的DGX SuperPOD计算机,可以用于处理万亿参数模型,保证超大规模生成式AI训练和推理工作负载的持续运行。
这款新型的AI超级计算机采用新型高效液冷机架级扩展架构,在FP4精度下可提供11.5exaflops的AI超级计算性能和240TB的快速显存,且可通过增加机架来扩展性能。
据介绍,每个DGX GB200系统搭载36个NVIDIA GB200超级芯片,共包含36颗NVIDIA Grace CPU和72颗NVIDIA Blackwell GPU,这些超级芯片通过第五代NVIDIA NVLink连接成一台超级计算机。与上一代NVIDIA H100 Tensor Core GPU相比,GB200超级芯片在大语言模型推理工作负载方面的性能提升了高达30倍。
基于Grace Blackwell架构的DGX SuperPOD由8个或以上DGX GB200系统构建而成,这些系统通过NVIDIA Quantum InfiniBand网络连接,可扩展到数万个GB200超级芯片。用户可通过NVLink连接8个DGX GB200系统中的576颗 Blackwell GPU,从而获得海量共享显存空间,赋能下一代AI模型。
黄仁勋表示: “NVIDIA DGX AI超级计算机是推进AI产业变革的工厂。新一代DGX SuperPOD集英伟达加速计算、网络和软件方面的最新进展于一体,能够帮助每一个企业、行业和国家完善并生成自己的AI。”
与此同时,英伟达还发布了用于AI模型训练、微调和推理的通用AI超级计算平台NVIDIA DGX B200系统。该系统同样基于全新的Blackwell架构系统,包含8颗NVIDIA B200 Tensor Core GPU和2颗英特尔处理器。DGX B200系统在FP4精度下可提供高达144petaflops的 AI 性能、1.4TB的GPU显存和64TB/s的显存带宽,该系统的万亿参数模型实时推理速度比上一代产品提升了15倍。
英伟达表示,全球合作伙伴预计将在今年晚些时候提供基于DGX GB200 和DGX B200系统构建而成的NVIDIA DGX SuperPOD。

构建更友好软件生态,降低GPU使用门槛
英伟达同时还宣布了多个软件方面的更新布局。其中最重要的一项更新是推出生成式AI微服务NVIDIA NIM,供开发者在已安装NVIDIA CUDA GPU的系统中创建和部署生成式AI助手。
据介绍,由GPU加速NVIDIA NIM微服务和云端端点目录,适用于经过优化的预训练的AI模型,可以在云、数据中心、工作站和PC等支持CUDA的数亿设备的GPU上运行。
一位国内芯片公司技术负责人对第一财经记者表示:“英伟达的软件进行了重要的功能升级,把以前开发者要干的事情都便利化了,提供更友好的算力环境,使得开发者更加依赖。”
上述人士表示,构建更友好的软件生态是英伟达的重要战略。“也就是以后使用GPU的门槛会越来越低,英伟达生态的粘性越来越高。”他说道。
英伟达还宣布将以API的形式提供Omniverse Cloud,从而使开发者能够更方便地将Omniverse的核心技术直接集成到现有的数字孪生设计与自动化软件应用中,或是集成到用于测试和验证机器人或自动驾驶汽车等自主机器的仿真工作流中。
一些全球大型工业软件制造商正在将Omniverse Cloud API加入到其软件组合中,包括Ansys、Cadence、达索系统旗下3DEXCITE品牌、Hexagon、微软、罗克韦尔自动化、西门子和Trimble等。
黄仁勋表示:“所有制造出来的产品都将拥有数字孪生。Omniverse是一个可以构建并操作物理真实的数字孪生的操作系统。Omniverse和生成式AI都是将价值高达50万亿美元的重工业市场进行数字化所需的基础技术。”
Omniverse Cloud API将于今年晚些时候在微软云Azure上以NVIDIA A10 GPU上的自托管API,或是部署在NVIDIA OVX上的托管服务的形式提供。
英伟达还宣布推出一个硬件和软件平台,用于构建包含生成人工智能功能的类人机器人。据黄仁勋介绍,新平台将包括一个为机器人和人工智能提供动力的计算机系统,以及包括生成式AI和其他工具在内的一套软件,以构建能与人进行交互的人形机器人。
举报 第一财经广告合作,请点击这里此内容为第一财经原创,著作权归第一财经所有。未经第一财经书面授权,不得以任何方式加以使用,包括转载、摘编、复制或建立镜像。第一财经保留追究侵权者法律责任的权利。 如需获得授权请联系第一财经版权部:021-22002972或021-22002335;banquan@yicai.com。 文章作者 
钱童心
相关阅读
大批参观者涌入英伟达总部:三万员工支撑两万亿市值,秘密在哪?透过英伟达建筑的刚硬线条,记者希望探寻这家公司崛起的本质。
1小时前 液冷时代有望加速来临7小时前 华尔街到陆家嘴精选|日本加息 美元上涨;医药AI出重磅;能源转型失败?油价创5个月新高
日本央行17年来首次加息,美元指数19日上涨;黄仁勋看好全球数据中心市场,预计英伟达将从中获得一大块收入。
10小时前
对话|黄仁勋回应中国市场和AI芯片定价问题 称英伟达市值合理黄仁勋在采访中仍然强调了中国市场的重要性。
12小时前
多家中国企业“现身”GTC大会 英伟达带来的产业影响有哪些?当黄仁勋一身皮衣走向GTC大会舞台时,现场观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。
昨天 16:28 一财最热 点击关闭
猜你喜欢
梅龙高铁预计9月通车!新塘站出发可到达梅州
6171
无息配资网:揭秘低门槛高收益背后的真相
9120
高盛:予中国移动(00941)“买入”评级 目标价825港元
5342
有基金公司将直播纳入基金经理绩效考核
3987
4月30日金至尊黄金价格1022元克
2751
惠州出招管理海岛!船舶进入限制海域将依法拘留
9569
Keep 盘中涨超10%,今日宣布股份回购计划
732
泰格医药(03347HK):拟5亿-10亿元回购A股股份 回购价格不超60元股
802
股票行情快报:凯旺科技(301182)3月1日主力资金净卖出26408万元
5413
我国与人工智能融合的国产桌面操作系统发布
5048
巴菲特:快乐的人更长寿,做自己认同的事
360数科出席数据治理与安全在线峰会,呼吁多方共建数据安全生态
生猪主力合约收跌05%
青涩男神蜕变记, 从少年到成熟, 短剧明星成长之路_挑战_柯淳_经历
论经济学家与财富追求及有钱人的经济学关联
美军发动空袭轰炸
中信证券:空置费打折不会全面摊开 即便打折对物业服务公司影响相对有限
4月28日浩瀚转债下跌098%,转股溢价率5859%
4月9日老凤祥黄金价格928元克
中信证券:医疗行业政策和业绩拐点趋势显现 板块迎来价值重估
