OpenAI新模型Astra 可自主找漏洞并发动网络攻击
2026-09-02分类:人工智能 阅读()

OpenAI 对即将推出的新模型Astra 发出一则带有警示意味的说明。根据OpenAI 9 月1 日的官方公告,Astra 是该公司首个达到「关键网络安全门槛」的大型语言模型,能在没有人类逐步指导的情况下,自行找出并利用未知的安全漏洞。
能自主找出零日漏洞并加以利用
依OpenAI 说明,Astra 具备找出「前所未知」安全漏洞(即所谓零日漏洞)并加以利用的能力,而且不需要人类一步步下指令。这使它落入OpenAI 自订「准备框架」(Preparedness Framework)中最进阶的「关键」(Critical)类别—也是该公司首次有模型跨过这道门槛。对资安领域而言,这意味着攻击端的自动化程度可能被大幅推高:原本需要熟练白帽或骇客投入大量时间的漏洞挖掘与利用,AI 有机会自主完成。上述能力均为OpenAI 官方所描述。
OpenAI 将限缩最强能力,仅开放资安联盟成员
正因为风险升高,OpenAI 表示虽然Astra 即将推出,但其最进阶的网络安全能力将采取更严格的存取限制,只开放给参与其资安联盟「Daybreak」的特定组织。换句话说,一般使用者可以用到Astra,但那些足以自主发动网络攻击的最强功能会被圈在受控范围内。这样的做法,反映了前沿AI 在「能力愈强、愈可能被滥用」与「如何负责任释出」之间的两难。
Tags:
