现场直击GTC大会|黄仁勋与九个人形机器人同台,新一代平台推理能力提升30倍
美国当地时间3月18日下午,全球瞩目的英伟达2024GTC大会在加州圣何塞SAP球场开幕。英伟达创始人CEO黄仁勋在主题演讲开场时风趣地说道:“这不是演唱会,这是开发者大会,我们会谈论很多计算机科学的话题。”
当黄仁勋一身皮衣走向舞台时,观众立刻沸腾。此前,有人把黄仁勋演讲的受关注程度与顶流歌星Taylor Swift的演唱会相提并论。
“我们正在以从未有过的方式来创建软件。”黄仁勋在演讲中强调,“这就需要构建更大的GPU。”
黄仁勋演讲时,英伟达的股价没有太大变化,竞争对手AMD股价大跌超过3%。
在演讲结束时,黄仁勋与正在使用英伟达软硬件平台开发的九款人形机器人共同登台,还与两个该公司正在测试的小型机器人进行互动。
大模型推理性能可提升30倍
在整场发布会上,最受关注的是英伟达基于下一代计算架构Blackwell超级芯片而构建的AI超级计算机。黄仁勋曾在多个场合表示,英伟达已经成为了一家平台公司。
黄仁勋率先发布了一款搭载英伟达GB200 Grace Blackwell超级芯片的DGX SuperPOD计算机,可以用于处理万亿参数模型,保证超大规模生成式AI训练和推理工作负载的持续运行。
这款新型的AI超级计算机采用新型高效液冷机架级扩展架构,在FP4精度下可提供11.5exaflops的AI超级计算性能和240TB的快速显存,且可通过增加机架来扩展性能。
据介绍,每个DGX GB200系统搭载36个NVIDIA GB200超级芯片,共包含36颗NVIDIA Grace CPU和72颗NVIDIA Blackwell GPU,这些超级芯片通过第五代NVIDIA NVLink连接成一台超级计算机。与上一代NVIDIA H100 Tensor Core GPU相比,GB200超级芯片在大语言模型推理工作负载方面的性能提升了高达30倍。
基于Grace Blackwell架构的DGX SuperPOD由8个或以上DGX GB200系统构建而成,这些系统通过NVIDIA Quantum InfiniBand网络连接,可扩展到数万个GB200超级芯片。用户可通过NVLink连接8个DGX GB200系统中的576颗 Blackwell GPU,从而获得海量共享显存空间,赋能下一代AI模型。
黄仁勋表示: “NVIDIA DGX AI超级计算机是推进AI产业变革的工厂。新一代DGX SuperPOD集英伟达加速计算、网络和软件方面的最新进展于一体,能够帮助每一个企业、行业和国家完善并生成自己的AI。”
与此同时,英伟达还发布了用于AI模型训练、微调和推理的通用AI超级计算平台NVIDIA DGX B200系统。该系统同样基于全新的Blackwell架构系统,包含8颗NVIDIA B200 Tensor Core GPU和2颗英特尔处理器。DGX B200系统在FP4精度下可提供高达144petaflops的 AI 性能、1.4TB的GPU显存和64TB/s的显存带宽,该系统的万亿参数模型实时推理速度比上一代产品提升了15倍。
英伟达表示,全球合作伙伴预计将在今年晚些时候提供基于DGX GB200 和DGX B200系统构建而成的NVIDIA DGX SuperPOD。
构建更友好软件生态,降低GPU使用门槛
英伟达同时还宣布了多个软件方面的更新布局。其中最重要的一项更新是推出生成式AI微服务NVIDIA NIM,供开发者在已安装NVIDIA CUDA GPU的系统中创建和部署生成式AI助手。
据介绍,由GPU加速NVIDIA NIM微服务和云端端点目录,适用于经过优化的预训练的AI模型,可以在云、数据中心、工作站和PC等支持CUDA的数亿设备的GPU上运行。
一位国内芯片公司技术负责人对第一财经记者表示:“英伟达的软件进行了重要的功能升级,把以前开发者要干的事情都便利化了,提供更友好的算力环境,使得开发者更加依赖。”
上述人士表示,构建更友好的软件生态是英伟达的重要战略。“也就是以后使用GPU的门槛会越来越低,英伟达生态的粘性越来越高。”他说道。
英伟达还宣布将以API的形式提供Omniverse Cloud,从而使开发者能够更方便地将Omniverse的核心技术直接集成到现有的数字孪生设计与自动化软件应用中,或是集成到用于测试和验证机器人或自动驾驶汽车等自主机器的仿真工作流中。
一些全球大型工业软件制造商正在将Omniverse Cloud API加入到其软件组合中,包括Ansys、Cadence、达索系统旗下3DEXCITE品牌、Hexagon、微软、罗克韦尔自动化、西门子和Trimble等。
黄仁勋表示:“所有制造出来的产品都将拥有数字孪生。Omniverse是一个可以构建并操作物理真实的数字孪生的操作系统。Omniverse和生成式AI都是将价值高达50万亿美元的重工业市场进行数字化所需的基础技术。”
Omniverse Cloud API将于今年晚些时候在微软云Azure上以NVIDIA A10 GPU上的自托管API,或是部署在NVIDIA OVX上的托管服务的形式提供。
英伟达还宣布推出一个硬件和软件平台,用于构建包含生成人工智能功能的类人机器人。据黄仁勋介绍,新平台将包括一个为机器人和人工智能提供动力的计算机系统,以及包括生成式AI和其他工具在内的一套软件,以构建能与人进行交互的人形机器人。
滕泰:总需求不足,企业怎么办
普通企业家通过什么样的新供给来创造新需求?在这儿给大家分享一个方法论,叫做从硬价值制造到软价值创造。当前阶段中国经济的主要矛盾是总需求不足。正是因为这个原因,中央经济工作会议和政府工作报告,把扩大内需作为今年的主要任务。以新供给创造新需求,破解总需求难题制约中国经济可持续增长的根本问题是总需求不足,而破解这个难题的核心难点就是国民收入支出的结构改革,把低效投资转化为居民消费支出。0000美国8月新增非农人口18.7万、失业率升至3.8%,9月暂停加息板上钉钉?丨环球读数
瑞银首席美国经济学家平格尔对第一财经表示,就业增幅在10万~20万之间对美联储都是稀松平常,表明经济继续放缓且不构成威胁。随着加息周期临近尾声,美国就业需求继续稳步下降。当地时间9月1日,美国劳工统计局公布的最新数据显示,8月新增非农就业人口18.7万,预期值为17万,前值由18.7万下修为15.7万。过去12个月,平均每月新增就业人口27.1万,远低于2022年的月平均值39.9万。锤子财富2023-09-02 15:57:150000理想芯片国产化率超25%,途虎养车和壳牌战略合作|第一财经汽车日评
在新能源和智能化领域,我国零部件企业的竞争力正在不断提升。理想L系列芯片国产化率超25%日前,理想汽车CEO李想在微博上发文称,最近网络上出现了很多关于“理想大量使用中国本土供应商”的说法。李想表示,“我们为大量使用中国本土供应商感到自豪,消费者敢买中国品牌的车,我们就敢大胆的使用中国本土的供应链企业。”此外他还透露,理想L系列芯片的国产化率超过25%。锤子财富2023-05-26 19:42:490000半年盘点|长春高新业绩止住了下滑,但“利润奶牛”几乎停止了增长
对比去年上半年,金赛药业今年上半年营收微增3.6%;归属于上市公司股东净利润增幅则更小,仅有0.27%。8月23日晚间,生长激素龙头企业长春高新(000661.SZ)发布了半年报,对比一季度下滑两成多,此次业绩终于有所止跌。半年报显示,今年上半年,长春高新实现营业收入61.68亿元,较上年同期增长5.77%;实现归属于上市公司股东净利润21.60亿元,同比增长1.91%。锤子财富2023-08-26 16:13:220000节后机票价格“跳水”低于高铁,增班在即的中美航线终于也降价了
多低国内机票价格不过百元,国际热门机票也降至千元以下。今年“五一”假期超过疫情前的高票价并没能持续,节后一周,不管是国内还是国际机票价格都在持续回落。今日,国内首家低成本航空公司春秋航空就开启了持续三天的特价机票大促,公司共拿出了10万张特价机票促销,不少航线低至百元上下。而在国际航线上,此前一直居高不下的中美航线,机票价格也终于松动了,不少航线6月的价格跌破万元。百元以下机票再现背后锤子财富2023-05-09 17:44:050000