OpenAI 暂缓 Astra 模型发布:因网络安全风险达“关键”级别

IT之家 8 月 8 日报道,OpenAI 正式宣布推迟代号为“Astra”的新一代人工智能模型的发布。根据 OpenAI 的《准备框架》,该模型在内部及专家评估中,展现出在智能体编程与网络安全领域的突破性能力,因此被列为首个在网络安全方面达到“关键”(Critical)风险级别的模型。根据该框架定义,AI 模型若满足两个条件之一即触及红线:一是无需人类干预即可在经过安全加固的系统中识别并开发零日漏洞利用程序;二是仅需提供高层级战略目标,即可针对加固目标自主构想并实施全新的端到端网络攻击。OpenAI 特别澄清,Astra 尚未发布,并未参与此前针对 Hugging Face 的网络攻击。为确保安全合规,OpenAI 宣布对高能力模型实施更严格的管控,包括设置隔离测试环境、限制网络访问、实施沙箱化运行以及对思维链进行监控审查,并暂停了内部不满足强化安全标准的 Astra 相关活动。OpenAI 表示将与政府及第三方安全组织合作测试。CEO 萨姆·奥尔特曼强调,虽然 Astra 性能强劲,公司致力于将其公开发布,但鉴于其在网络安全方面的强大能力,需要更多时间确保万无一失。

事件分析

此次 Astra 模型被标记为“关键”风险,标志着人工智能在**智能体自主性**与**网络攻防能力**上迎来了一个危险的技术里程碑。当模型具备无干预挖掘零日漏洞及发起端到端攻击的能力时,它已从辅助编程工具进化为具有实质性破坏力的数字资产,这对现有的网络安全防御体系提出了全新挑战。OpenAI 此次主动暂停发布并强化沙箱隔离,体现了在 AI 能力指数级增长的背景下,行业领头羊正试图通过“防御性部署”来平衡技术落地与安全风险。未来,随着 AI 编程能力的提升,网络安全攻防战将完全转变为 AI 对抗 AI 的形态,高阶模型的发布门槛将更多地取决于其安全对齐(Alignment)与可控性,而非单纯的性能参数。

💡 核心观点:当 AI 智能体能力足以独立攻破安全防线,“安全刹车”将成为比“加速引擎”更决定生死的产业命题。

原文链接:Linux.do

C code80.ai · AI 编码 API 聚合 Claude / GPT 多模型统一接入,稳定不限速,按量计费,几行配置接入 Claude Code。 了解一下 ›

抢沙发

评论前必须登录!

立即登录   注册