2026年9月30日星期三
AI 基础设施 · 新闻与分析
首页 › 芯片与硬件 › 报道
芯片与硬件 · 报道

Xilinx推出用于数据中心计算、网络和存储工作负载的Alveo U50 FPGA加速器。

基于FPGA的加速正在成为针对特定数据中心工作负载的GPU替代方案。
行业媒体Slicast · 2019年8月6日 UTC 12:00 · 全球 · 来源: forbes.com
重要度 55

在圣克拉拉加州圣克拉拉会议中心正在进行的Flash Memory Summit上,赛灵思公司推出了Alveo U50,这是其可适配数据中心加速器家族的新成员。Alveo U50基于该公司的UltraScale+ FPGA架构,针对多种数据中心工作负载的横向扩展和特定领域加速。

Alveo U50是首款支持PCI Express 4.0的半高/半长加速卡,相比PCI Express 3.0解决方案,每条通道的可用带宽翻倍。该卡支持CCIX互联,配备8GB HBM2(高带宽内存),峰值带宽为460GB/s,以及28MB内部SRAM,提供24TB/s的带宽。单个QSFP29 100GbE网络接口支持4x 10GbE、4x 25GbE、1x 40GbE或1x 100GbE配置。Alveo U50提供872K个LUT(查找表),功耗仅为75W,并支持NVMe-oF(NVM Express over Fabrics)解决方案。其外形尺寸和低功耗特性使其与几乎所有现代服务器兼容,无需额外供电。

"数据中心需求的不断增长正在将现有基础设施推向极限,这推动了对可适配解决方案的需求,以便在各种工作负载上优化性能并延长现有基础设施的生命周期,最终降低TCO(总体拥有成本),"赛灵思数据中心事业部副总裁兼总经理Salil Raje表示。"新的Alveo U50为数据中心工作负载带来了优化的外形尺寸和前所未有的性能和可适配性,我们继续与不断增长的应用合作伙伴生态系统协作,为各行各业提供以前无法实现的能力。"

赛灵思声称Alveo U50可在机器学习推理、视频转码、数据分析、计算存储、电子交易和金融风险建模等领域提供显著优势。根据赛灵思提供的数据,在语音翻译和深度学习推理工作负载中,Alveo U50相比NVIDIA Tesla T4的延迟降低25倍,吞吐量提高10倍。在运行TPC-H Query数据库基准测试时,Alveo U50相比Intel Xeon Platinum 8260处理器的单小时吞吐量高4倍,成本显著更低,且在电子交易和金融建模中相比Xeon及Xeon + Tesla配置提供了更低的延迟和更高的效率。计算存储加速测试显示,与纯CPU解决方案相比,压缩/解压缩吞吐量提高20倍,每节点成本降低超30%。

赛灵思Alveo U50现已向OEM厂商进行工程样品供应,计划于秋季正式推出。

阅读原文
Xilinx推出用于数据中心计算、网络和存储工作负载的Alveo U50 FPGA加速器。 · Slicast