头条 · 报道
中国美团使用5万块国产AI芯片训练1.6万亿参数LLM,展示绕过美国出口管制的可行性。
表明中国可独立于美国限制在国产芯片上开发具竞争力的大规模模型,重塑全球计算能力地理分布。
行业媒体Slicast · 2026年7月3日 UTC 14:39 · 美国 · 来源: Crypto Briefing
重要度 94美团,这家以外卖配送闻名的公司,在6月30日发布了LongCat-2.0——这是中国开发的最具意义的AI模型之一。该模型包含1.6万亿参数,并完全在50,000块国产GPU芯片集群上训练,没有涉及NVIDIA硬件。
该模型采用混合专家(MoE)架构,其中1.6万亿总参数包括每个任务约48亿个活跃参数。LongCat-2.0在超过30万亿个token上预训练,支持100万token的上下文窗口。在Terminal Bench 2编码基准测试中,它得分70.8,与全球领先模型处于竞争力强的位置。50,000块芯片的国产集群代表了使用非NVIDIA硬件进行的规模最大的已报告训练运行。
这一发展出现之际,美国一直在逐步加强对华高级AI芯片的出口管制,基于限制中国获得顶级NVIDIA芯片会制约北京AI能力的假设。
另外,Moonshot AI一直在推进其Kimi模型系列,其变体达到1万亿参数,在15.5万亿个token上训练。Kimi K2系列具有约32亿个活跃参数,并采用专有的MuonClip优化器,旨在训练期间保持稳定性。研究指出Moonshot AI的工作与美团使用的大型国产训练集群之间没有直接关联。