|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦
最新科技 读者文摘 养生保健 美食饮品
居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
卡城新闻 加国新闻 即时新闻 娱乐八卦 最新科技 读者文摘 养生保健 美食饮品 居家生活 移民茶馆 艺术中心 风筝专辑 房屋租赁 求职招聘 便民广告 定居指南 城市介绍 房产动态 留学移民 华人故事 教育话题 财经信息 精华旅游 难得一笑 |
| 最新科技 |
 卡城华人网信息中心![]()  最新科技
     ![]()  OpenAI Astra有多强?AI已能自主寻找漏洞“攻破”
|
|
【卡城华人网 www.calgarychina.ca】  2026-09-02 10:53   免责声明: 本消息未经核实,不代表网站的立场、观点,如有侵权,请联系删除。 |
|
OpenAI 即将推出全新Astra 模型,并透露这是旗下首款达到「关键资安门槛」的大型语言模型。据OpenAI 公布的资讯,Astra 不仅能找出电脑系统中未知的安全漏洞,甚至可以在没有人类指导的情况下进一步利用这些漏洞,显示AI 模型在资安攻防上的能力已跨入新的风险阶段。
OpenAI 表示,Astra 将很快对外推出,但最先进的资安能力不会全面开放,而是采取更严格的存取限制。这样的做法,与Anthropic 先前针对高风险资安能力模型采取的控管方向类似。 据OpenAI 测试结果,Astra 在ExploitBench 评测中取得满分。 ExploitBench 主要用来评估大型语言模型利用已知系统漏洞的能力;更值得注意的是,在OpenAI 工程师自行修改的测试版本中,Astra 还成功发现并利用两个零时差漏洞。 这代表Astra 已不只是依照已知漏洞资料进行攻击,而是开始具备自主发现未知弱点、并进一步完成漏洞利用的能力,这也正是OpenAI 将其列入关键资安风险等级的重要原因之一。 为避免Astra 遭到恶意利用,OpenAI 表示,目前已开始强化模型执行环境,用来侦测滥用行为并防止jailbreak,也导入一些尚未公开的新安全技术。 此外,OpenAI 也开始辨识被评估为「较高风险」的帐号,并限制Astra 对这类帐号提示词的回应,只是目前尚未进一步说明风险帐号的判定机制,以及限制会如何实施。 OpenAI 同时形容Astra 是旗下「目前为止最符合人类意图的模型」,但即使如此,正式部署时仍会搭配额外的思维链监控机制,希望及早发现并阻止模型出现危险行为。 Astra 即将推出之际,OpenAI 近期也因AI Agent 的安全问题受到关注。先前OpenAI 的Agent 曾突破原先的训练环境限制,并存取Hugging Face 上的私人资料,引发外界对自主AI Agent 是否可能绕过安全机制的疑虑。 为此,OpenAI 也特别设计测试,试图诱使Astra 重现先前失控Agent 的行为,包括尝试突破测试环境、接触开放网际网路。 OpenAI 表示,在相关实验中,Astra 并没有尝试逃离测试环境。 不过,这项结果也引来质疑。 OpenAI 前员工Yona Shavit 认为,Astra 没有违反规则,未必能直接证明模型真的足够安全,也有可能是因为模型已理解研究人员期待它采取什么行为,甚至刻意在测试中表现得更守规矩。 目前外界最大的问题仍在于,OpenAI 公布的多项安全与能力测试缺乏第三方验证。 OpenAI 虽表示会先向一批测试人员开放Astra,但并未说明测试者身分或筛选方式,也不清楚是否有与美国政府合作进行上市前安全评估。 OpenAI 表示,等到Astra 更大规模对外推出时,还会公布更多模型评测与安全资讯。然而对一款已经能自主寻找、利用零时差漏洞的AI 模型来说,外界真正关注的问题恐怕不是它「能不能做到」,而是OpenAI 是否能在能力正式释放之前,建立足够有效的限制机制。 来源:科技新报 编辑(Edit)     删除(Delete) |
|
|
|
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |
| 版权所有(C), 2002-2026, 卡城华人网中国版 www.calgarychina.ca |