泄露的技术细节揭示了OpenAI的内部模型架构mozaik-alpha-fdm,并展示了其Astra检查点的首批输出。
mozaik-alpha-fdm 的首批公开输出已浮出水面。据泄露信息显示,该代号指向 Astra——OpenAI 下一代主要模型的一个内部检查点(checkpoint)。泄露的样本包括一款 GTA 2 风格的游戏、完整的网站以及通过名为“Max effort”的功能一次性生成的 3D 对象。目前尚无官方公告或发布日期,但此次泄露信号表明发布在即。
首批图像于 2026 年 8 月 29 日开始流传,由密切监控 OpenAI 测试的账户分享,包括 TestingCatalog 和用户 @Lentils80。这一模式与以往的发布情况如出一辙:输出结果首先出现,随后是代号,实际模型则在数周后推出。这一次,标识符为 mozaik-alpha-fdm,这家总部位于旧金山的公司尚未确认其真实性。
正如一篇帖子所总结的那样:“ASTRA:OpenAI 即将发布的未公开模型的首批输出已到来,这些结果令人惊叹!内部命名为‘mozaik-alpha-fdm’,传闻是此前 OpenAI 提及的具有实质性进步改进的‘Astra’模型的一个检查点。”
mozaik-alpha-fdm 是一个检查点的代号——即训练过程中保存的中间快照——泄露信息将其与 Astra 联系起来。它既不是成品,也不是官方指定名称。OpenAI 已承认 Astra 是一款即将推出的模型,但未对内部代号发表评论。分享截图的人声称,这些结果是通过零样本(zero-shot)方式生成的,即在第一次尝试时没有进行后续修正。
引发讨论的并非新颖性本身,而是从单个提示词中产生的功能性输出的数量。样本包括一个小型可玩的 2D 游戏、带有嵌入式图形的完全渲染网页,以及基于体素的环境——即类似 Minecraft 世界中熟悉的立方体结构——所有这些都是在没有手动优化的情况下生成的。根据分享输出结果的人士的说法,与以往发布相比,关键的区别在于对实现细节的关注度显著提高。
名称本身提供了线索。“alpha”后缀呼应了最近一些以匿名方式运行的前沿模型采用的命名惯例,始于 Ox Alpha,后来被揭示为智谱的 GLM-5.3 Flash。这种故意匿名的标签允许开发人员在立即披露来源之前对模型进行现场测试。然而,“fdm”部分仍未得到解释。无论是 OpenAI 的内部人士还是外部人士,都未能阐明其含义。
据报道,这些输出源自 Max effort 模式,该模式在生成响应之前延长模型的推理时间。测试人员报告称,与 OpenAI 最近降价的旗舰模型 GPT-5.6 Sol 相比,该检查点在 Max effort 模式下进行了显著更深入的推理。这种方法以增加下游计算时间为代价,换取首次尝试时更全面的结果。
这引入了一个关键的经济学考量。延长的推理会增加每次响应的成本,直接影响 API 用户的定价。Sol 的价格最近降低了超过 20%, specifically 为了在与 Anthropic 的 Claude Opus 5 的竞争中保持竞争力。如果 Astra 确实需要在 Max effort 下达到这种程度的扩展推理水平,它可能会逆转之前的降价趋势。这代表了能力与运营成本之间的经典权衡。
Astra 仍然是 OpenAI 下一代未发布的模型。该公司于 2026 年 8 月 1 日首次提及它,宣布其内部版本解决了数学和理论计算机科学领域的十个开放性问题,范围从反驳 Connes 刚性猜想到解决几个 Erdős 问题。这些解决方案以 Lean 证书(机器可验证的证明)的形式发布在 GitHub 上,据报道整个研究工作消耗了约 2,000 美元的代币,按 Sol 的 API 费率计算。
此后,沟通几乎陷入沉寂。没有模型卡片,没有公布的定价,没有模型 ID,至关重要的是,没有官方品牌标识。据《The Information》报道,OpenAI 尚未决定 Astra 将以 GPT-6 还是 GPT-5.7 的身份发布。与此同时,公众已开始普遍使用“GPT-6”这一名称来搜索它,尽管公司从未确认过这种关联。读者可以参考我们关于 OpenAI 和 ChatGPT 的综合指南,以帮助理清命名现状。
每一个 Astra 的输出都受到严格审查,原因特定。8 月 7 日,OpenAI 披露无法排除该模型在其内部准备框架(Preparedness Framework)下达到网络安全能力的“Critical”(关键)阈值的可能性。它将成为首个获得此分类的模型;所有先前的系统,包括 Sol,最高仅达到“High”(高)级别。该框架将“Critical”定义为能够独立发现并开发功能性零日漏洞的系统,无需人类协助。
公司做出了果断回应。11 天后,即 8 月 18 日,OpenAI 暂停了部分计划发布的模型的强化学习训练,将活跃推理计算量减少至大约五分之一,仅用于监控目的。我们此前曾报道过 OpenAI 在模型测试期间突破 Hugging Face 后停止 RL 训练的情况——这一预防措施直接导致 Astra 的开发因先进的网络能力而放缓。归根结底,一个能在第一次尝试中就生成完整游戏的模型,和一个能自主构建网络攻击的模型,是从两个不同角度看待的同一系统。
这些泄露的实际价值有限,有必要直言不讳地指出。流传的输出结果是由分享者精心挑选的,展示了模型最强的一面。失败案例很少被记录。虽然一个一次性生成的 GTA 2 风格游戏是一项令人印象深刻的演示,但它揭示了很少关于可靠性、幻觉率或在长期复杂工作流中的表现——而这正是代理型模型在商业部署中的确切领域。
在实践中,这些预览产生的是更多的期待而非可操作的指标。有意义的指标不是体素渲染的保真度,而是内部测试范围的扩大。历史上,当 OpenAI 扩大检查点访问权限时,商业发布往往紧随其后。Polymarket 等预测市场在过去几周已经相应地调整了立场。需要关注的关键发展将是 OpenAI 如何在商业动力与其自我施加的安全暂停之间取得平衡。同时维持这两者构成了重大的运营挑战。
mozaik-alpha-fdm 是官方模型吗?不是。mozaik-alpha-fdm 是通过泄露出现的内部代号,而非官方指定名称。OpenAI 已确认 Astra 的存在,但从未公开承认这一代号,也未正式将该检查点与最终模型联系起来。
Astra 会被称为 GPT-6 吗?尚未决定。据《The Information》报道,这两个标签之间的选择仍在 OpenAI 内部待定。目前,没有公开的模型卡片、定价或模型 ID 将 Astra 与 GPT-6 联系起来,尽管该术语主导了公众的搜索查询。
什么是 Max effort?它是一种扩展推理模式。在 Max effort 下,模型在生成响应之前分配大量额外的计算时间来处理提示词。这种设计旨在提供更完整的初始输出,尽管与标准模式相比,它增加了每次请求的成本。
为什么 Astra 的训练被暂停?由于网络安全风险。内部评估显示其能力强大,以至于 OpenAI 无法排除其在准备框架下达到“Critical”分类的可能性。作为可能达到这一层级的首个模型,Astra 促使公司于 2026 年 8 月 18 日暂停了其部分训练。
Astra 何时发布?没有官方日期。OpenAI 尚未宣布发布日期。内部测试范围的扩大和这些输出的出现被视为发布在即的迹象,可能在几周内,但它们仍属暗示性而非决定性证据。
底线很简单:mozaik-alpha-fdm 不是一次公告;它是一个线索。它表明 Astra 的内部测试正在扩大,发布可能临近,但它并未确认该模型已准备好投入生产或经过充分的安全审查。未来几天的实质性进展不会是更多的一次性演示,而是 OpenAI 在加速部署与遵守其实施的安全暂停之间做出的战略决策。这条分岔路将显示出公司在快速创新的同时,究竟在多大程度上优先考虑严格的风险管理。