英伟达首席执行官确认Blackwell GPU架构将在2024年第四季度交付。
英伟达首席执行官黄仁勋在周三高盛科技会议上就Blackwell GPU架构交付延迟和人工智能投资回报率的问题做出回应。虽然之前承诺Blackwell将在2024年下半年发货,但黄仁勋确认交付将在日历年Q4开始,这是因为公司在第二季度财报电话会议上发现的制造缺陷需要修改掩膜。该架构在去年春天英伟达的GTC大会上发布,承诺性能提升2.5倍到5倍,内存容量和带宽是其所替代H100级设备的两倍多。黄仁勋将交付延迟和股票波动部分归咎于客户需求的强劲:"需求如此之大,以至于我们的组件、技术、基础设施和软件的交付对人们来说真的很重要,因为它直接影响他们的收入,直接影响他们的竞争力,"他解释道。根据黄仁勋的说法,对Blackwell产品的需求已经超过了2022年推出的上一代Hopper产品的需求,那是在ChatGPT的出现使生成式人工智能成为必需品之前。
关于投资回报率的担忧,黄仁勋辩称GPU加速带来的性能提升远超基础设施成本。他声称,使用Spark——"目前世界上使用最广泛的数据处理引擎",用户可以看到"20:1的速度提升",即使基础设施成本增加一倍,也相当于"节省10倍"。在生成式人工智能方面,黄仁勋表示:"回报率非常出色,因为需求非常强劲,服务提供商与我们每花费一美元就能产生5美元的租赁价值。"不过,他承认建立在这一基础设施之上的应用程序和服务的投资回报率仍然不太确定。
在谈及人工智能的应用场景时,黄仁勋强调了他公司部署定制AI代码助手,并声称"每一行代码都由软件工程师编写的时代已经完全结束了"。他还吹捧了生成式人工智能在计算机图形学中的应用,解释了英伟达的DLSS技术:"我们计算一个像素,推断其他32个。"他认为这些技术对自动驾驶汽车、机器人技术、数字生物学和其他新兴领域至关重要。
黄仁勋主张更聪明的数据中心设计可以帮助降低成本。他指出,英伟达的模块化集群设计——称为SuperPOD——可以创建整个数据中心,能够将大规模计算浓缩到单个系统中,这就是英伟达能够对每个机架收取数百万美元的原因,因为每个机架"替代了数千个节点"。不过,他警告说,将这些密集系统——每个机架多达120千瓦——放入传统数据中心是低效的。相反,他提议将分散的50、100或200兆瓦数据中心浓缩为更小的设施,这些设施可以利用液冷来提高效率。随着Blackwell的推出,英伟达的高端产品被设计为可通过液体冷却,这使该公司能够推动数据中心的现代化。