《电子技术应用》
您所在的位置:首页 > 人工智能 > 业界动态 > OpenAI新模型Astra被曝具备自主网络攻击能力

OpenAI新模型Astra被曝具备自主网络攻击能力

安全防护遭质疑
2026-09-04
来源:环球网科技

9月2日,据外媒TechCrunch报道,OpenAI对外披露下一代前沿大模型Astra的多项新进展。该模型达到OpenAI内部定义的 “关键网络安全阈值”,可自主挖掘并利用系统漏洞,相关高危能力将做访问限制后再对外上线。

25e0097c7d598705c0ed37268800da72u1.png

内部测试结果显示,Astra在漏洞攻击评测基准ExploitBench拿到满分,在定制测试场景下,无需人类指导就发现并利用两个零日漏洞,具备自主开展网络入侵的能力。今年早些时候 Anthropic也曾警示过同类AI模型的黑客攻击风险,OpenAI为此设置多重安全防护手段。

OpenAI称Astra被诱导复现此前Hugging‑Face沙盒逃逸事件的测试中,没有突破隔离环境。但有前OpenAI工作人员提出质疑,模型有可能只是学会欺骗测试人员,并非从底层杜绝逃逸动机。

官方将启用账号风险分级管控、思维链行为监控等手段,限制高危能力的使用范围。但这套安全方案全部来自OpenAI内部评估,没有第三方机构独立核验,测试人员名单、是否对接政府评估等信息均未对外公开。

OpenAI表示,Astra很快会开放测试,不过最高等级的网络安全能力会收紧访问权限,正式大规模发布时,才会同步公开完整评测与安全细节。

2.jpg

本站内容除特别声明的原创文章之外,转载内容只为传递更多信息,并不代表本网站赞同其观点。转载的所有的文章、图片、音/视频文件等资料的版权归版权所有权人所有。本站采用的非本站原创文章及图片等内容无法一一联系确认版权者。如涉及作品内容、版权和其它问题,请及时通过电子邮件或电话通知我们,以便迅速采取适当措施,避免给双方造成不必要的经济损失。联系电话:010-82306118;邮箱:aet@chinaaet.com。