中国存储巨头考虑以100+亿美元估值IPO;同时,主要国内科技企业公开竞购数千个NVIDIA B300芯片,摒弃了先前的谨慎态度。
过去,大型公司在通过中介渠道进行采购时通常隐瞒真实身份。如今,越来越多的项目在直接签署合同,掩饰身份的努力也少得多。
与此同时,B300芯片正被主要客户迅速采购。华东一家互联网巨头已采购超过2000台,华北一家科技领袖企业也收购了约一千到二千台。仅有少数几家公司就消耗了大部分市场供应。
中国两家领先存储制造商的上市进程继续吸引资本市场关注。据报道,一家存储巨头的IPO估值有望从数千亿元上调至万亿元级别,而上市时间表可能相比之前预期有所延迟。
多位业内人士表示尚未收到明确的估值上调确认,但普遍认为进一步的估值调整不会令人意外。随着估值上升,现有股东的股权价值可能面临重新评估,这样规模的企业进入A股市场也可能对现有半导体上市公司的市值造成压力。
一家上海AI芯片公司在去年年底完成IPO辅导后,过去六个月没有取得新的进展。据说该公司之前未获得"绿色通道"批准,上市过程中遭遇了一些挑战。然而,得到去年高层访问的支持,该公司现已获得了IPO"绿色通道",上市进程出现转机迹象。据了解,投资者目前正在与该AI芯片公司就IPO前融资展开讨论。
继存储价格上涨后,涨价开始在整个AI产业链中蔓延。近期,NVIDIA 5090租赁价格上涨约20%,与此同时,CDN价格也上涨了接近20%。
但两者的深层逻辑不同。5090价格上涨主要源于需求增长——随着推理和Agent应用快速发展,高端GPU面临持续供应短缺。相比之下,CDN价格上涨则主要受低成本PCDN资源压力驱动。
业内人士指出,CDN处理模型、图像、视频等内容的数据分发,是连接用户与计算中心的关键网络基础设施。近年来,PCDN通过边缘节点和P2P技术不断压低带宽成本。随着电信运营商加强治理,低成本供应减少,CDN价格已重新踏上上升轨道。
众多业内从业者认为,模型适配本身已不再是核心障碍;真正让公司产生差异的是性能优化能力。即使在适配达到相当水平后,不同芯片制造商之间的性能差异仍然显著。据了解,某统一生态系统内部维持着详细的评分系统和成绩,但由于某些制造商对横向对比敏感,对外仅公开"通过"和"未通过"两类。
一些员工加入了京东与国内芯片制造商的合资企业紫晶无限,而其他关键成员则选择了自主创业。其中,由核心员工Jeffrey Xu共同创立的新公司成立于今年5月,专注于AI推理芯片和软硬件系统。据业内人士透露,该公司成立后不久就获得了超1亿元融资。
一些AI芯片公司选择了吸收成本并维持产品定价,辩称公司仍处于不盈利的市场扩张阶段,订单和客户比利润更重要。
然而,一些公司为这种做法付出了代价。一家AI芯片公司之前已几乎敲定的智能计算项目因存储价格上涨导致成本波动而告吹。项目方要求双方分担额外成本,但该公司态度坚决拒绝妥协,最终丧失了订单。
一些供应商透露,来自某些大客户的逾期付款已成为常态。更不寻常的是,一些大型企业集团之前要求只能现金支付,禁止使用承兑汇票。但现实已转变为"没有现金可用,因此无法支付"。当供应商主动提出接受汇票时,客户以"违反规定"为由拒绝,最后供应商既未获现金也未得到汇票,被迫继续等待。"如果一年都收不到现金怎么办?"已成为众多供应商面临的普遍困境。
据业内人士介绍,新产品主要针对大规模训练集群场景,重点是与NVIDIA H100平台竞争,单卡定价达数万元。与其他行业公司频繁举办产品发布会不同,该公司一直保持着低调态度。
据芯片行业人士介绍,算力运营商的客户多来自运营或软件背景,缺乏硬件评估基础,仅根据token数难以判断不同芯片的价值。因此,这些客户往往依赖算力运营商提供硬件选型方案。
过去,算力运营商几乎全部采用NVIDIA产品。如今,为满足客户多样化的性价比需求,运营商开始主动测试国产芯片,与NVIDIA产品进行实际对比。
然而,测试是一回事;实际部署仍然面临障碍。互联网巨头拥有强大的工程团队,能够独立完成适配和优化,而大多数中央和国有企业客户的数据中心只有懂基本运维的员工,缺乏芯片适配能力。即使运营商已验证某国产芯片可行,这些客户仍然犹豫——因为一旦出现问题,他们缺乏技术能力来处理。
因此,中央和国有企业客户选择了一条"安全"之路:盲目复制国家电网等行业龙头的配置方案,直接部署高端芯片。以某供应链集团为例——其业务数据主要包括物流和指令,部署7B或11B模型就足够了,却亦步亦趋采用了高端芯片,导致性价比极差。
一家台湾主板制造商推出了DDR5单通道主板,直接删除了一个子通道以降低芯片需求。一些工业控制制造商已重新启用DDR3支持,优先考虑供应链方案。与此同时,其他制造商推出了DDR4/DDR5双模兼容设计,保留了客户切换的灵活性。
根据从业者的计算,跨越100公里的传输延迟约为1毫秒,跨越10000公里仅约0.1秒。对于典型首token响应时间为200-300毫秒的大模型而言,跨区域调度引入的额外延迟并不如人们想象的那样大。