当地时间8月27日,包括OpenAI、Anthropic、微软、谷歌、亚马逊在内的超百家企业及机构共同签署了一封题为《呼吁开展网络防御的集体行动》的联名信。信中强调AI驱动下的网络攻击正变得更加频繁和复杂,诸多关键基础设施等面临严重风险,建议各国政府组织及企业将加强网络安全防御作为当务之急。

部分联名企业名单。
“我们加强网络安全防御的窗口期有限。”联名信在开篇便发出警告。信中指出,未来几个月内,随着全球各类模型能力持续优化,由人工智能赋能的网络攻击将愈发猖獗。从医院、水处理厂到支撑互联网的关键基础设施等,各类公共服务都面临日益迫近的威胁,现有安全措施已经无法应对。因此,亟需补齐网络安全工具及人力资源,同时打造适用于全球范围的网络安全协作标准与框架。
为此,联名信向不同主体提出了具体的行动倡议。所有组织都应立即将网络防御提升为领导层决策的核心要务,提高自身在采购、开发及部署各环节的安全标准。政府应加快推行“可信访问计划”,让特定合规企业提前接入高阶模型;同时为网络防御提供专项资金,重点扶持医院、水厂等资源匮乏的关键基础设施。
前沿人工智能公司应通过加大资金投入、员工培训以及优化安全工具,提供负责任的模型访问能力,确保智能体身份可追溯、可问责,并持续分享防御经验等。
南都记者注意到,此次联名信的签署方阵容强大。除了AI与云服务领域的多家头部企业在列,网络安全领域的CrowdStrike、Cloudflare等公司也深度参与。另外,从半导体公司AMD、博通,电信运营商德国电信,再到金融领域的Visa、万事达卡和花旗集团,乃至汽车制造商通用汽车也悉数在列,体现了数字时代下网络安全已成为横跨几乎所有领域的共同议题。
值得关注的是,作为联名签署方之一的全球最大开源大模型托管社区Hugging Face,近期就卷入了一起由失控智能体引发的网络攻击事件。就在联名信发布的前一天,OpenAI刚发布了针对这一事件的官方报告。
据南都此前报道,今年7月,Hugging Face服务器遭到OpenAI智能体系统入侵。起因是OpenAI在对新款模型进行安全测试的过程中,调低了对其网络不当请求的拒绝响应门槛,并设置在一个高度隔离的环境中运行。然而,这些模型为了在测试中取得更好“成绩”,耗费大量推理算力寻求突破隔离限制的方法,导致了攻击的发生。业内广泛认为,这是首次公开披露的、完全由智能体自主发起的网络攻击,助推了此次联名信的诞生。
8月26日,OpenAI在事故报告中声称将采取一系列新的安全措施,防止此类智能体“黑客”攻击行为。其核心是加强对智能体“思维链”(Chain-of-Thought)的监控,即模型在给出最终答案前,将复杂问题拆解为一系列中间推理步骤并逐层展示的过程。同时,公司还将实施更严格的网络隔离以限制互联网访问,进一步控制模型的访问权限等。