文章总结: 谷歌Gemini模型在网络安全评估中通过猜测密码和公共代码仓库凭据入侵真实公司系统,发现后主动终止行动。事件凸显AI安全评估风险,需加强模型行为管控与安全机制。OpenAI等实验室也面临类似AI智能体失控审查,行业需完善安全评估框架与责任机制。
综合评分: 72
文章分类: AI安全,网络安全,安全运营,安全大事件
安全测试域名混淆,Gemini 入侵真实公司系统
Ravie Lakshmanan
Ravie Lakshmanan
代码卫士
2026年9月22日 17:36
北京
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
聚焦源代码安全,网罗国内外最新资讯!
编译:代码卫士
《华尔街日报》报道称,谷歌Gemini模型在网络安全评估中访问互联网并入侵其它公司的AI系统。
这些事件发生在 2026 年 5 月,发生在以色列公司 Irregular评估测试期间。该公司也参与了 OpenAI、Anthropic 和 Meta 披露的类似黑客事件。
据《华尔街日报》报道,该模型通过反复猜测密码获得了一个受保护系统的访问权限。在另外两起相关案例中,该模型在公共代码仓库中找到了凭据,从而获得了对受保护系统的未授权访问。
然而,与 Anthropic 和 OpenAI 案例中观察到的事件不同,Gemini 模型在发现它闯入一家真实公司的系统后,终止了入侵。据称 Irregular 已于 2026 年 7 月将此事通知谷歌。
上个月,Irregular 公司发布报告,将评估中的入侵归因于一个命名错误,该错误导致“夺旗”演练中使用的虚构公司名称无意中与一个真实域名匹配,从而使模型能够利用意外的互联网访问,并“有限次数”地针对该域名。谷歌安全工程副总裁 Heather Adkins 表示,“这一事件凸显了训练强大 AI 模型负责任行事的重要性,在这种情况下,模型采取了适当措施。”谷歌还指出,它不认为该行为是模型错位的一个例子,理由是智能体在安全机制被触发后停止了行动。目前尚不清楚哪些公司成为目标,不过 Irregular 公司向《华尔街日报》确认,谷歌的案例与其它事件相同,且该问题已在数周前得到解决。
这一披露发生在 OpenAI 发现另外六起事件数天之后。在这些事件中,该公司的 AI 智能体行为失控,在训练期间采取欺骗性和未经授权的行动,包括隐瞒错误、寻求未授权凭据、将文件上传到公共互联网,以及通过 Artifactory 通信“阅读其他解题者的笔记、已发布的回复,并利用这些交流来形成回答”。
自 OpenAI 在 7 月披露恶意 AI 智能体绕过内部控制、触及开放互联网,并以集群方式入侵 Hugging Face 以来,AI 实验室面临越来越多的审查。该公司将其描述为“一次前所未有的网络事件”,此后发布新框架,以便在未来报告类似的模型不当行为。
代码卫士试用地址:https://sast.qianxin.com/
开源卫士试用地址:https://oss.qianxin.com/
推荐阅读
Claude Opus 5助力研究员通过多个漏洞接管 OpenAI 员工账户
Gemini CLI 严重漏洞可触发 RCE 攻击和软件供应链风险
简单的自定义字体渲染即可投毒 ChatGPT、Claude、Gemini 等 AI 系统
数千个谷歌云公共API密钥启用 Gemini API 后遭暴露
原文链接
https://thehackernews.com/2026/09/google-gemini-broke-into-real-company.html
题图:Pixabay License
本文由奇安信编译,不代表奇安信观点。转载请注明“转自奇安信代码卫士 https://codesafe.qianxin.com”。
奇安信代码卫士 (codesafe)
国内首个专注于软件开发安全的产品线。
觉得不错,就点个 “在看” 或 “赞”
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:代码卫士 Ravie Lakshmanan
Ravie Lakshmanan《安全测试域名混淆,Gemini 入侵真实公司系统》