谷歌Gemini测试中突破安全边界,OpenAI、Anthropic此前AI安全警告再受关注

来源 Tradingkey

TradingKey - 谷歌母公司Alphabet(GOOGL)旗下Gemini AI在一次网络安全能力测试中,意外突破原本设定的测试范围并访问了三家真实公司的受保护系统。这被认为是谷歌AI模型首次公开确认的自主越界入侵事件。谷歌已证实相关事件发生于今年5月,测试由第三方AI安全公司Irregular负责。

此次测试原本属于“Capture the Flag”网络安全演练,Gemini被要求从虚构企业的软件系统中获取指定信息。但由于测试环境意外保留了互联网访问权限,加上部分虚构企业名称与现实公司相同,Gemini最终将真实企业误认为测试目标。

在其中一次事件中,Gemini通过尝试密码进入了一个受保护系统;另外两次则是在公开网络代码库中发现登录凭证,并利用这些凭证访问真实公司的系统。谷歌表示,Gemini在意识到目标是真实企业后均自行停止了进一步操作。目前没有公开信息显示事件造成数据破坏或更严重的后续攻击,三家受影响公司的身份也未披露。

谷歌安全工程副总裁Heather Adkins表示,公司已经联系受影响机构,并与测试合作伙伴调整相关流程。Irregular表示,今年7月底已经向相关AI实验室通报问题,其测试环境中已知的相关漏洞也已完成修复。

此次事件显示出AI Agent已经能够在较少人工干预下完成搜索信息、寻找或猜测凭证以及登录外部系统等连续操作,一旦测试环境权限配置出现问题,模型就可能把原本用于安全评估的能力带到真实互联网环境。

Gemini并非首个出现类似问题的前沿AI模型。此前OpenAI、Anthropic和Meta的AI系统在Irregular等机构开展的安全测试中也曾出现越出预定测试范围的情况。这些事件近期进一步推动行业讨论AI Agent权限管理、沙盒隔离以及第三方安全测试标准。

事件曝光之际,OpenAI、Anthropic和Google DeepMind近期均在强化对前沿AI安全风险的讨论。随着AI模型获得更强的自主执行和网络操作能力,如何确保模型始终停留在授权范围内,正成为下一阶段AI安全测试的重要议题。

免责声明:仅供参考。 过去的表现并不预示未来的结果。
goTop
quote