AMD已发布ROCm 10并使ROCm.AI全面可用,标志着其开源AI软件栈十年来的成熟。
2026年8月31日,AMD发布了ROCm 10,以此纪念其软件栈运行十周年,并使ROCm.AI正式全面可用。ROCm.AI最初在“Advancing AI 2026”大会上亮相,这是一款原生AI软件体验,旨在加速开发速度并优化AMD硬件上的性能表现。
ROCm.AI统一了三大核心开发者体验:AMD Skills、ROCm CLI和AMD Hyperloom。通过将AMD专属专业知识和智能体工作流直接嵌入熟悉的开发者工具中,该平台使创新能够紧跟AI技术的进步。利用针对内核、内存管理和调度的AI驱动优化,配置了ROCm.AI的系统在相同硬件上相比ROCm 7实现了平均3.3倍的推理性能提升和2.4倍的训练性能提升。
**为AMD上的AI打造全新开发者体验**
该平台引入了简化的工作流程,支持工程师跨越AI开发生命周期的三个关键阶段:优化推理性能、利用AMD专业知识进行构建以及运行AI工作负载。
**使用AMD ROCm Hyperloom优化端到端推理**
作为ROCm.AI的核心组件,Hyperloom是一个自主智能体系统,旨在优化主机代码和GPU内核上的端到端推理工作负载。它自动分析工作负载配置文件,识别瓶颈,探索优化路径,实施针对性调整,对结果进行基准测试,并验证性能和正确性。ROCm 10将Hyperloom的兼容性扩展至AMD Instinct GPU,增加了对vLLM和SGLang的支持。开发人员可以指导针对HIP、Triton和FlyDSL的优化,并获得详细报告,其中概述了建议的代码修改以及测量或预期的性能增益。Hyperloom通过独立工作流和AMD Skills无缝集成,为开发人员提供了将智能体优化嵌入现有管道的灵活方法。
**利用AMD专业知识进行构建**
AMD Skills将精选的AMD知识和经过验证的工作流直接注入到领先的AI编码代理中,包括Claude Code、Cursor和Codex。这为开发人员在其首选环境中提供了AMD特定的指导。ROCm 10显著扩大了AMD Skills目录,涵盖三个领域:用于本地AI和应用集成的客户端原生工作流;涵盖诊断、路由、重放分析和优化的跨堆栈工作流;以及专为AMD Instinct GPU和AMD EPYC处理器设计的服务器原生工作流,包括模型服务、性能分析和性能剖析。此前在Advancing AI上预览的技能现在可通过Claude Code、Codex和Cursor市场以及GitHub上的开放目录访问。每个发布的技能都经过严格的结构和行为测试,以确保一致且可靠的工作流程。
**以更简单的工作流程运行**
ROCm CLI目前作为ROCm.AI中的技术预览版提供,为在AMD硬件上配置、管理和运行AI工作负载提供了一个稳定统一的命令行界面。工程师可以手动执行这些工作流,利用AI编码代理,或在持续集成(CI)环境中部署它们。单一界面整合了系统检查、ROCm环境安装与管理、模型服务、诊断、组件更新和运行时控制。该CLI提供适用于Windows和Linux的预构建二进制文件,无需预先安装ROCm即可独立运行。它配置受管理的ROCm环境,支持多个并行运行的运行时,具备激活和回滚功能,并包含集成的模型服务和引擎管理。当前的适配器支持在选定的AMD客户端系统上运行Lemonade,以及在AMD Instinct GPU上运行vLLM进行模型服务。
与CLI捆绑的是ROCm Console(前身为“dash”),它提供对系统状态和工作负载活动的实时可见性。用户可以跟踪ROCm运行时健康状况、模型服务操作、GPU利用率以及基准遥测数据,包括在高带宽内存(HBM)使用率、功耗和兼容AMD Instinct系统上的每瓦特令牌数等关键指标方面。作为技术预览版,ROCm CLI保持了从ROCm 7.13版本开始的跨版本无关体验,官方对ROCm 10的支持即将发布。
**基于ROCm 10软件栈构建**
这些开发者体验建立在扩展后的ROCm 10软件栈之上,以ROCm Core SDK为核心。该SDK为在AMD平台上开发和部署AI工作负载建立了更模块化的架构。除了SDK之外,ROCm 10还引入了库、编译器、框架、开发者工具、模型支持、性能优化和硬件平台兼容性的全面更新。有关ROCm Core SDK的全面细分——包括库、编译器、工具、框架和模型支持、性能提升及平台更新——请参阅完整的ROCm 10技术深度解析。
**关于AMD**
AMD(纳斯达克股票代码:AMD)致力于推进高性能和AI计算,以应对世界上最关键的挑战。如今,AMD技术支撑着数十亿次体验,涵盖云和AI基础设施、嵌入式系统、AI PC和游戏。凭借全面的AI优化CPU、GPU、网络解决方案和软件组合,AMD提供全栈AI解决方案,专为智能计算新时代所需的性能和可扩展性而设计。更多信息请访问www.amd.com。