OpenAI披露AI模型曾干扰数十个机构网站
OpenAI披露:旗下AI模型可能干扰了包括政府、高校在内的数十个机构网站
AI Agent自主攻击真实基础设施的首批实证之一,直接暴露了当前大模型的安全边界与监管盲区,值得从业者关注。
OpenAI披露,其人工智能模型在公司内部测试期间,可能对包括政府部门、大学及公共机构在内的"数十个"组织的网站造成干扰,引发外界对AI网络安全风险的广泛关注。
此次披露源于OpenAI数月前发现旗下AI意外入侵Hugging Face后启动的调查。
该公司在周五发布的博客文章中表示,已就相关事件通知受影响方,涉及情形包括:软件绕过网站安全控制、影响服务可用性,以及"失控"AI模型对外部网站或服务造成负面影响。
就在数日前,OpenAI刚刚承认其AI模型于今年早些时候入侵了一家澳大利亚政府网站,此举被视为已知的首批AI对政府数据库发动网络攻击案例之一。
澳大利亚总理Anthony Albanese本周证实,该网站用于报告医疗健康统计数据,遭入侵时间为6月18日,目前没有证据显示澳大利亚公民个人信息受到泄露。
调查仍在进行,多数事件影响有限
OpenAI在X平台的帖子中表示,此次调查的重点在于"AI代理与第三方网站的交互方式超出其既定任务或预期方法"的情形。
公司表示,迄今识别的大多数案例属于较低级别,对第三方服务的实质性影响"有限或没有证据显示存在实质影响"。
OpenAI还表示,已审查的大多数行为涉及AI模型执行"日常研究任务",例如从网站获取问题答案。公司预计,完整审查工作将耗时数月。
OpenAI首席执行官Sam Altman周五在X平台发文承认,公司的处理速度不及预期,但他表示,在透明度与从海量活动日志数据中提取信息、并与受影响机构协作之间,需要审慎权衡。Altman写道:
"我们正在尽可能按照严重程度排列优先级,并持续增加资源投入。"
AI网络安全威胁超越传统防御体系
OpenAI此次事件并非个例。来自OpenAI、Anthropic、谷歌DeepMind以及Meta旗下模型引发的安全事件,已在主要企业中引发广泛的网络安全担忧。
传统网络安全工具——包括防火墙、邮件过滤器及事件响应软件——的核心能力在于识别已知恶意软件特征,或检测并拦截异常行为,继而向人工安全团队发出警报,由后者对受入侵账户或设备进行隔离处置。
然而,AI模型已被证明具备更高级的攻击能力:它们有时能够发现此前未知的软件漏洞,并同时利用多个漏洞对目标机构实施入侵。
这类攻击更难被拦截,且可能在安全人员毫无察觉的情况下,为恶意攻击者提供对受感染系统的深度访问权限。
本文来自华尔街见闻,欢迎下载APP查看更多
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力