
9月2日,OpenAI计划“很快”推出Astra模型,但将限制其最先进网络安全功能的使用范围。该公司周二表示,该模型将“很快”发布,但未透露具体时间。这是OpenAI在8月暂停Astra部分内部工作、加强安全防护后首次对外披露的最新进展。
公司称,Astra的高级网络安全能力最初仅向少数测试人员开放,随后将通过“Daybreak Blue”项目向更多用户提供用于防御目的的访问权限,并配套网络安全防护措施。这一“分阶段+定向开放”策略,被视为OpenAI在能力释放与安全风险之间寻找平衡的最新尝试。OpenAI曾于8月暂停Astra部分内部工作以加强安全防护。
OpenAI周二(9月2日)表示,Astra已达到“关键网络安全门槛”,可在无人干预下识别并开发零日漏洞利用程序。这意味着Astra在网络安全攻防两端都具备相当强的能力——既可被用于主动发现漏洞、协助防御,也可被滥用于网络攻击。能力越强,滥用风险越大,这正是OpenAI对高级网络安全能力采取“限制性开放”策略的根本原因。
为防止滥用,OpenAI进一步强化了模型防护措施,包括监控未经授权的行为并自动停止相关活动。这种“模型内置防护+外部监控”的双重机制,是当前大模型在网络安全领域应用的常见做法,但实际效果仍有待在真实场景中持续验证。
从行业视角看,Astra模型的发布意味着OpenAI在企业级安全能力方面又迈出关键一步。AI驱动的安全攻防正成为网络安全行业的重要趋势,传统基于规则与签名的防护体系正面临革新压力。OpenAI选择“防御性优先”的开放策略,既符合监管层对AI安全的高度关注,也有助于OpenAI在政府、企业客户中建立负责任的AI品牌形象。后续随着Astra能力逐步解锁,AI在渗透测试、威胁情报、自动化响应等场景的应用有望进入新阶段。
从商业化进程看,OpenAI此前已将Astra的部分能力嵌入ChatGPT订阅服务和企业级API,但Astra独立模型的发布意味着其能力体系将更加完整。网络安全之外,Astra预计还将在代码生成、复杂推理、工具使用等通用能力上有显著提升。Daybreak Blue项目的防御性定位,既是OpenAI承担AI安全责任的具体体现,也是其在政府、国防、金融等高度敏感行业拓展市场的重要策略——这些行业对AI能力的应用有严格的“白帽子”约束。后续Astra在安全能力上的开放节奏,将成为观察OpenAI如何在能力释放与风险防控之间持续寻找平衡的关键窗口。

