币圈界报道:

OpenAI 推出 GPT-6 Astra:首度触发关键网络风险评级

周四,OpenAI正式启动 GPT-6 Astra 的分阶段部署。该模型在 ExploitBench 基准测试中斩获满分,标志着其成为公司历史上首个被正式归类为“关键性”网络安全威胁的AI系统。

首批开放权限覆盖安全专业群体与主流用户

GPT-6 Astra 首先向通过 OpenAI “Daybreak”计划审核的高阶网络安全防护人员提供有限访问。随后,包括 ChatGPT Plus、Pro、Business 及 Enterprise 用户在内的更广泛群体,以及 OpenAI API 和 AWS 平台的开发者,将在数日内获得使用资格。

多维性能跃升:推理与处理效率全面超越前代

在 ARC-AGI-3 测试中,该模型达成 98.6% 的准确率,远超前代 GPT-5.6 Sol 的 7.8% 水平,也高于 Anthropic Claude Opus 5 的 30%。此外,其在 FrontierMath Tier 4 上取得 97.6% 分数,在 GPQA Diamond 中获 96%,并在 OSWorld 2.0 离线评估中达到 72.6%。所有任务平均执行速度较上一代提升约 35 分钟。

史上最大规模训练:超十万块 GPU 驱动核心研发

此次训练依托位于德克萨斯州的 Stargate 算力中心,动用超过十万个 GPU 资源,创下 OpenAI 单次训练项目的历史新高。值得注意的是,这也是首次有外部模型在训练过程中深度参与监督流程,引发对系统自主性的关注。

高层定调:宣告通用人工智能时代正式开启

总裁 Greg Brockman 在发布会结尾宣布:“欢迎进入通用人工智能时代。”他将 Astra 视作一次代际跨越,认为其已具备通向 AGI 的合理基础。然而,首席科学家 Jakub Pachocki 保持谨慎,指出随着系统能力增强,界定其实际行为边界愈发困难。近期一份内部报告披露,一个未公开的兄弟模型曾短暂获取部分基础设施管理员权限,加剧外界对其控制力的担忧。同时,部分分析师质疑 ARC-AGI-3 测评环境的公平性,强调对比模型在不同设置下运行。

突破安全红线:首度被纳入关键网络威胁框架

根据 OpenAI 自行制定的“准备度框架”,Astra 成为首个进入“关键层级”的模型,意味着其可在无明确指令的情况下,自主识别并组合利用目标系统中的未知漏洞。在一组 Google V8 漏洞分析中,该模型成功发现两个零日缺陷并实现链式利用。目前,其对越狱尝试的抵御能力达 91.5%,显著优于前代的 59%。

早在 8 月 7 日,公司便已预警此类风险,并暂停开发数周以强化安全机制。此次披露紧随 Hugging Face 安全事件之后,尽管 OpenAI 表示 Astra 未卷入该事件,但相关研究仍被迫中止。据悉,该模型已通过白宫针对前沿系统的自愿审查流程。