>>返回【卡城华人网】主页




卡城新闻   加国新闻   即时新闻   娱乐八卦    最新科技   读者文摘   养生保健   美食饮品    居家生活   移民茶馆   艺术中心   风筝专辑   
房屋租赁   求职招聘   便民广告   定居指南    城市介绍   房产动态   留学移民   华人故事    教育话题   财经信息   精华旅游   难得一笑   

>>返回【卡城华人网】主页





卡城新闻  加国新闻  即时新闻  娱乐八卦
最新科技  读者文摘  养生保健  美食饮品
居家生活  移民茶馆  艺术中心  风筝专辑
房屋租赁  求职招聘  便民广告  定居指南
城市介绍  房产动态  留学移民  华人故事
教育话题  财经信息  精华旅游  难得一笑

最新科技
 卡城华人网信息中心
 最新科技
     OpenAI Astra有多强?AI已能自主寻找漏洞“攻破”

OpenAI Astra有多强?AI已能自主寻找漏洞“攻破”

【卡城华人网 www.calgarychina.ca】  2026-09-02 10:53
  免责声明: 本消息未经核实,不代表网站的立场、观点,如有侵权,请联系删除。
【卡城华人网】OpenAI Astra有多强?AI已能自主寻找漏洞“攻破”

OpenAI 即将推出全新Astra 模型,并透露这是旗下首款达到「关键资安门槛」的大型语言模型。据OpenAI 公布的资讯,Astra 不仅能找出电脑系统中未知的安全漏洞,甚至可以在没有人类指导的情况下进一步利用这些漏洞,显示AI 模型在资安攻防上的能力已跨入新的风险阶段。



OpenAI 表示,Astra 将很快对外推出,但最先进的资安能力不会全面开放,而是采取更严格的存取限制。这样的做法,与Anthropic 先前针对高风险资安能力模型采取的控管方向类似。

据OpenAI 测试结果,Astra 在ExploitBench 评测中取得满分。 ExploitBench 主要用来评估大型语言模型利用已知系统漏洞的能力;更值得注意的是,在OpenAI 工程师自行修改的测试版本中,Astra 还成功发现并利用两个零时差漏洞。

这代表Astra 已不只是依照已知漏洞资料进行攻击,而是开始具备自主发现未知弱点、并进一步完成漏洞利用的能力,这也正是OpenAI 将其列入关键资安风险等级的重要原因之一。

为避免Astra 遭到恶意利用,OpenAI 表示,目前已开始强化模型执行环境,用来侦测滥用行为并防止jailbreak,也导入一些尚未公开的新安全技术。

此外,OpenAI 也开始辨识被评估为「较高风险」的帐号,并限制Astra 对这类帐号提示词的回应,只是目前尚未进一步说明风险帐号的判定机制,以及限制会如何实施。

OpenAI 同时形容Astra 是旗下「目前为止最符合人类意图的模型」,但即使如此,正式部署时仍会搭配额外的思维链监控机制,希望及早发现并阻止模型出现危险行为。

Astra 即将推出之际,OpenAI 近期也因AI Agent 的安全问题受到关注。先前OpenAI 的Agent 曾突破原先的训练环境限制,并存取Hugging Face 上的私人资料,引发外界对自主AI Agent 是否可能绕过安全机制的疑虑。

为此,OpenAI 也特别设计测试,试图诱使Astra 重现先前失控Agent 的行为,包括尝试突破测试环境、接触开放网际网路。 OpenAI 表示,在相关实验中,Astra 并没有尝试逃离测试环境。

不过,这项结果也引来质疑。 OpenAI 前员工Yona Shavit 认为,Astra 没有违反规则,未必能直接证明模型真的足够安全,也有可能是因为模型已理解研究人员期待它采取什么行为,甚至刻意在测试中表现得更守规矩。

目前外界最大的问题仍在于,OpenAI 公布的多项安全与能力测试缺乏第三方验证。 OpenAI 虽表示会先向一批测试人员开放Astra,但并未说明测试者身分或筛选方式,也不清楚是否有与美国政府合作进行上市前安全评估。

OpenAI 表示,等到Astra 更大规模对外推出时,还会公布更多模型评测与安全资讯。然而对一款已经能自主寻找、利用零时差漏洞的AI 模型来说,外界真正关注的问题恐怕不是它「能不能做到」,而是OpenAI 是否能在能力正式释放之前,建立足够有效的限制机制。

来源:科技新报

编辑(Edit)     删除(Delete)







>>返回【卡城华人网】主页




版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca

版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca