现场直击GTC大会|黄仁勋与九个人形机器人同台,新一代平台推理能力提升30倍
2024-05-31 【 字体:大 中 小 】
美国当地时间3月18日下午,全球瞩目的英伟达2024GTC大会在加州圣何塞SAP球场开幕。英伟达创始人CEO黄仁勋在主题演讲开场时风趣地说道:“这不是演唱会,这是开发者大会,我们会谈论很多计算机科学的话题。”
当黄仁勋一身皮衣走向舞台时,观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。
“我们正在以从未有过的方式来创建软件。”黄仁勋在演讲中强调,“这就需要构建更大的GPU。”
黄仁勋演讲时,英伟达的股价没有太大变化,竞争对手AMD股价大跌超过3%。
在演讲结束时,黄仁勋与正在使用英伟达软硬件平台开发的九款人形机器人共同登台,还与两个该公司正在测试的小型机器人进行互动。
大模型推理性能可提升30倍
在整场发布会上,最受关注的是英伟达基于下一代计算架构Blackwell超级芯片而构建的AI超级计算机。黄仁勋曾在多个场合表示,英伟达已经成为了一家平台公司。
黄仁勋率先发布了一款搭载英伟达GB200 Grace Blackwell超级芯片的DGX SuperPOD计算机,可以用于处理万亿参数模型,保证超大规模生成式AI训练和推理工作负载的持续运行。
这款新型的AI超级计算机采用新型高效液冷机架级扩展架构,在FP4精度下可提供11.5exaflops的AI超级计算性能和240TB的快速显存,且可通过增加机架来扩展性能。
据介绍,每个DGX GB200系统搭载36个NVIDIA GB200超级芯片,共包含36颗NVIDIA Grace CPU和72颗NVIDIA Blackwell GPU,这些超级芯片通过第五代NVIDIA NVLink连接成一台超级计算机。与上一代NVIDIA H100 Tensor Core GPU相比,GB200超级芯片在大语言模型推理工作负载方面的性能提升了高达30倍。
基于Grace Blackwell架构的DGX SuperPOD由8个或以上DGX GB200系统构建而成,这些系统通过NVIDIA Quantum InfiniBand网络连接,可扩展到数万个GB200超级芯片。用户可通过NVLink连接8个DGX GB200系统中的576颗 Blackwell GPU,从而获得海量共享显存空间,赋能下一代AI模型。
黄仁勋表示: “NVIDIA DGX AI超级计算机是推进AI产业变革的工厂。新一代DGX SuperPOD集英伟达加速计算、网络和软件方面的最新进展于一体,能够帮助每一个企业、行业和国家完善并生成自己的AI。”
与此同时,英伟达还发布了用于AI模型训练、微调和推理的通用AI超级计算平台NVIDIA DGX B200系统。该系统同样基于全新的Blackwell架构系统,包含8颗NVIDIA B200 Tensor Core GPU和2颗英特尔处理器。DGX B200系统在FP4精度下可提供高达144petaflops的 AI 性能、1.4TB的GPU显存和64TB/s的显存带宽,该系统的万亿参数模型实时推理速度比上一代产品提升了15倍。
英伟达表示,全球合作伙伴预计将在今年晚些时候提供基于DGX GB200 和DGX B200系统构建而成的NVIDIA DGX SuperPOD。
构建更友好软件生态,降低GPU使用门槛
英伟达同时还宣布了多个软件方面的更新布局。其中最重要的一项更新是推出生成式AI微服务NVIDIA NIM,供开发者在已安装NVIDIA CUDA GPU的系统中创建和部署生成式AI助手。
据介绍,由GPU加速NVIDIA NIM微服务和云端端点目录,适用于经过优化的预训练的AI模型,可以在云、数据中心、工作站和PC等支持CUDA的数亿设备的GPU上运行。
一位国内芯片公司技术负责人对第一财经记者表示:“英伟达的软件进行了重要的功能升级,把以前开发者要干的事情都便利化了,提供更友好的算力环境,使得开发者更加依赖。”
上述人士表示,构建更友好的软件生态是英伟达的重要战略。“也就是以后使用GPU的门槛会越来越低,英伟达生态的粘性越来越高。”他说道。
英伟达还宣布将以API的形式提供Omniverse Cloud,从而使开发者能够更方便地将Omniverse的核心技术直接集成到现有的数字孪生设计与自动化软件应用中,或是集成到用于测试和验证机器人或自动驾驶汽车等自主机器的仿真工作流中。
一些全球大型工业软件制造商正在将Omniverse Cloud API加入到其软件组合中,包括Ansys、Cadence、达索系统旗下3DEXCITE品牌、Hexagon、微软、罗克韦尔自动化、西门子和Trimble等。
黄仁勋表示:“所有制造出来的产品都将拥有数字孪生。Omniverse是一个可以构建并操作物理真实的数字孪生的操作系统。Omniverse和生成式AI都是将价值高达50万亿美元的重工业市场进行数字化所需的基础技术。”
Omniverse Cloud API将于今年晚些时候在微软云Azure上以NVIDIA A10 GPU上的自托管API,或是部署在NVIDIA OVX上的托管服务的形式提供。
英伟达还宣布推出一个硬件和软件平台,用于构建包含生成人工智能功能的类人机器人。据黄仁勋介绍,新平台将包括一个为机器人和人工智能提供动力的计算机系统,以及包括生成式AI和其他工具在内的一套软件,以构建能与人进行交互的人形机器人。
举报 第一财经广告合作,请点击这里此内容为第一财经原创,著作权归第一财经所有。未经第一财经书面授权,不得以任何方式加以使用,包括转载、摘编、复制或建立镜像。第一财经保留追究侵权者法律责任的权利。 如需获得授权请联系第一财经版权部:021-22002972或021-22002335;banquan@yicai.com。 文章作者
钱童心
相关阅读
透过英伟达建筑的刚硬线条,记者希望探寻这家公司崛起的本质。
1小时前 液冷时代有望加速来临7小时前 华尔街到陆家嘴精选|日本加息 美元上涨;医药AI出重磅;能源转型失败?油价创5个月新高
日本央行17年来首次加息,美元指数19日上涨;黄仁勋看好全球数据中心市场,预计英伟达将从中获得一大块收入。
10小时前
黄仁勋在采访中仍然强调了中国市场的重要性。
12小时前
当黄仁勋一身皮衣走向GTC大会舞台时,现场观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。
昨天 16:28 一财最热 点击关闭

猜你喜欢

东莞股票配资:助力投资者放大收益,实现财富梦想


比依股份:中报净利润缩水超4成,现金流告负,应收款高企


很佛系,能成大事的几个星座


美媒大量报道:副总统在白宫被边缘化?哈里斯正面回应,并透露尚未与拜登讨论2024年竞选一事


王导:黄金大阴线杀跌,2433直接空


中国突围技术封锁 先进封装是排头兵


盘前有料|央行、金融监管总局召开专家座谈会……重要消息还有这些


中信里昂:上调信义光能(00968)评级至“跑赢大市” 目标价升至57港元


2024大出行行业创新论坛:跨界融合、数字赋能,出行更美好


持有现金小幅下降,短期债务覆盖程度偏弱


美军发动空袭轰炸


中信证券:空置费打折不会全面摊开 即便打折对物业服务公司影响相对有限


4月28日浩瀚转债下跌098%,转股溢价率5859%


4月9日老凤祥黄金价格928元克


中信证券:医疗行业政策和业绩拐点趋势显现 板块迎来价值重估


汉武帝在位54年,有40多年在跟匈奴打仗,他为何那么执着于打匈奴_汉朝_卫青和_国家


儿童掏耳朵用什么工具?2025最受欢迎儿童可视掏耳勺,舒适又安全!_耳道_产品_功能


快速扩张叠加原材料涨价,传音控股毛利率两年下滑10个百分点


CWG资讯:市场担忧高关税冲击,美元周一显著回落,金价逆转跌势上涨p


欧盟委员会提议对部分美国产品征收25%关税
