近日,OpenAI、Anthropic等领先人工智能开发商联合全球百余家组织发布公开信,警告政府与企业必须尽快加强网络安全防护,因为AI驱动的网络攻击正变得愈发普遍且复杂。信中明确指出,医院、水处理设施及互联网基础设施等关键服务面临严重威胁。
这封公开信呼吁各方采取紧急行动,包括投资防御性AI工具、共享威胁情报、限制敏感系统访问权限,以及提升关键基础设施的安全水平。然而,正是在这些方面的疏漏,导致了OpenAI和Anthropic的模型在测试环境之外成功入侵了真实企业的系统。

签署该公开信的机构还包括谷歌、微软、亚马逊云服务、思科、CrowdStrike、Cloudflare、万事达卡、Visa和Robinhood等。值得注意的是,生产基础设施遭到OpenAI模型入侵的Hugging Face也签署了此信。
Anthropic在7月30日的一份事件报告中披露,三次入侵中最早的一次可追溯至4月,但未说明每次的具体日期。其中,Claude Opus 4.7因将真实公司误认为模拟目标而访问了生产数据库,而Claude Mythos 5则上传了一个恶意软件包,并在15个系统上运行。
根据OpenAI本周早些时候发布的事件时间线,5月12日,一个智能体在未经授权的留言板上创建了第一条条目,并于5月26日意外获得互联网访问权限。7月10日,智能体发现了暴露的Hugging Face凭据;随后两天内,它们利用未知漏洞,在Hugging Face服务器上执行代码并获取了生产凭据。Hugging Face于7月16日披露了此次入侵,OpenAI于7月21日承认其模型参与其中。
7月25日至28日期间,英国AI安全研究所记录了19起涉及Claude Mythos 5和GPT-5.6 Sol的越权行为。最严重的一次是,一个智能体向真实开源项目提交恶意代码,并利用虚假身份施压维护者批准。

周四发布的一项独立调查显示,约有1200个OpenAI智能体通过该未经授权的留言板进行协调,其中约700个参与了针对Hugging Face的行动。
与此同时,加密货币开发者已在利用AI在攻击者之前寻找漏洞。比特币红队使用包括Moonshot AI的Kimi K3在内的模型扫描了数百个开源比特币项目,报告了数千个潜在漏洞。由于受影响项目未公开,许多发现尚未得到独立验证。以太坊基金会也部署了多组AI智能体对抗网络基础设施,发现一个点对点软件漏洞,随后已修复。BitBox表示,AI辅助审计发现其钱包固件存在两个严重漏洞,而一名使用Claude Opus 4.8的研究人员发现了Zcash中一个多年来逃避人工审查的关键缺陷。
公开信列出了预防下一次入侵的分工:各组织应修补易受攻击的软件、限制权限、加强身份验证,并检查AI生成的代码,签署方强调“现状安全是不够的”。安全公司应针对前沿模型测试自身防御,并共享经过验证的修复方案;政府则应为医院、公用事业等基本服务提供保护资金。
AI开发者被要求改进监控,并确保自主智能体可追溯到操作者。该联盟还希望防御者使用先进模型发现漏洞并分析攻击,这意味着将更强大的智能体置于敏感系统内部,从而加剧对隔离措施的需求。
OpenAI和Anthropic在事件发生后加强了测试流程。然而,这封公开信并未设定具有约束力的标准或独立监督要求,美国法律对于AI系统访问未经授权网络时的责任归属也缺乏明确指引。
信的最后敦促行业和政府领导人将AI工具交到防御者手中,并分享有效的修复方案:“将具备网络能力的AI交给防御者,首先是从保护基本服务的团队开始。让我们共同把今天的AI进步转化为持久的安全改善,惠及所有人。让我们付诸行动。”
