芯片与硬件 · 报道
推理芯片初创公司d-Matrix宣布其Raptor内存型XPU将通过英伟达的NVLink Fusion互联与英伟达Rackscale Iron平台集成。
与英伟达生态系统和平台的集成证明了推理加速器的市场牵引力,并为客户在特定推理工作负载上提供了英伟达原生H系列的替代方案。
行业媒体Slicast · 2026年9月11日 · 美国 · 来源: Crypto Briefing
重要度 70自己打造AI芯片很难,要把它大规模投入生产机架可能更难。专注于推理的半导体创业公司D-Matrix宣布了一条捷径:其下一代Raptor XPU将直接连接到NVIDIA的NVLink Fusion互连中,从而能够访问NVIDIA多年来完善的整个机架级基础设施。
根据这项合作,Raptor加速器将通过NVIDIA第六代NVLink网络结构连接,并集成到MGX参考架构机架中。基于Raptor的MGX系统预计在2027年推出,首批单元预计在第四季度交付。
NVIDIA在2025年推出的NVLink Fusion允许第三方XPU和CPU利用NVLink的低延迟链路,无需从头构建自己的网络堆栈。该集成支持机架级配置,在单个全对全NVLink域中最多可容纳144个Raptor加速器。与传统以太网互连相比,每条连接的XPU到XPU延迟降低3倍,每个XPU通过第六代NVLink网络结构最多可访问3 TB/s的带宽。
D-Matrix首席执行官Sid Sheth强调,此次合作加速了超低延迟推理用例的部署——编码助手、聊天机器人和语音代理。该公司将Raptor系统定位为与NVIDIA的基于GPU的机架并行工作,处理分散的推理工作负载。
D-Matrix从2024年11月开始发货其上一代Corsair XPU。在完成4.5亿美元融资后,该公司估值达到20亿美元。Raptor芯片目前处于最终设计阶段,预计在2026年底完成。与NVIDIA的多年产品路线图表明这是一项持续的合作,将在未来的芯片代次中持续演进,而非一次性集成。
D-Matrix还与Astera Labs合作,在NVLink Fusion框架内提供定制化的连接解决方案。