阿里巴巴由台积电代工制造的5纳米RISC-V XuanTie C950芯片现已原生运行Qwen-3.8 27B模型,展示了深度的垂直整合能力。
阿里巴巴似乎正在效仿英伟达(NVIDIA)成熟的垂直整合战略,为其定制版 RISC-V 处理器玄铁 C950 提供对其高性能 Qwen-3.8 27B AI 模型的“零日”支持。值得注意的是,该模型仅需 32GB 显存即可运行。
玄铁 C950 于 2026 年 3 月发布,定位为基于 RISC-V 的端侧 AI 解决方案。与传统 ASIC 通常依赖传统 GPU 处理 AI 工作负载不同,该芯片作为服务器级 64 位 RISC-V 处理器运行。它在单个硅片上集成了 64 个计算核心,可扩展时钟频率高达 3.20GHz。多个包含八个核心的集群通过高速 AMBA CHI 总线原生互联。为了高效管理高要求的 AI 任务,矩阵和向量加速引擎直接嵌入架构中,从而消除对独立 GPU 的依赖。
玄铁 C950 采用了标准的 L1 缓存、灵活且高度可配置的 L2 缓存,并支持可选的共享 L3 缓存,以缓解核心间通信瓶颈。此外,该芯片采用硬件级别的智能数据预取算法,能够预测内存请求,在执行引擎实际需要之前将数据字符串加载到缓存层级中。
阿里巴巴平头哥玄铁 RISC-V 团队在宣布这一进展时表示:“阿里巴巴平头哥玄铁 RISC-V 团队宣布对 Qwen-3.8 模型(特别是 27B 版本)提供零日支持。其 64 核 C950 CPU(支持 RVV)解码速度可达每秒 30 个 token,首字延迟(TTFT)仅为 1.9 秒。玄铁系列拥有针对不同边缘应用的广泛 RISC-V 芯片产品线。阿里现在可以出售…… https://t.co/yF731bykS1 pic.twitter.com/qmHfiZBxpa”
这一公告凸显了该芯片的核心性能能力。凭借对 Qwen-3.8 27B 模型的零日原生支持,玄铁 C950 实现了每秒 30 个 token 的解码速度和仅 1.9 秒的首字延迟(TTFT)。
作为背景参考,Qwen-3.8 27B 是一个拥有 270 亿参数的开源权重 AI 模型,具备与 Opus 4.5 相当编码能力,同时足够轻量,可在单台 MacBook 上运行。
通过将对该模型的零日支持集成到玄铁 C950 中,阿里巴巴旨在加深客户在其生态系统中的留存率,并显著扩展其计算灵活性。该公司可以在数据中心内将 C950 与其他 AI 加速器无缝配对,以优化推理工作负载。
关于作者:写作是我唯一不可动摇的热情所在。在过去六年中,我撰写了超过 2,200 篇涉及金融和技术主题的独特文章,总字数近 100 万字。自 2025 年起作为 Wccftech 移动团队成员,以及多伦多大学罗特曼商学院项目的校友,我为所涵盖的每一个话题带来细微差别、深入知识和独特视角。当我不是在工作时,我正在环游世界,作为一名 aspiring food connoisseur(美食鉴赏家),探索隐藏的糖果店和餐厅。
关注 Google 上的 Wccftech,以便在你的信息流中获得更多我们的新闻报道。