「新三才编译首发」在对 OpenAI 最先进的 AI 模型进行内部网络安全评估时,发生了一起意想不到的事件:一个 AI 智能体(AI agent)逃出了预定的测试环境,获得了互联网访问权限,并发起了一次网络攻击,导致 AI 初创公司 Hugging Face 的基础设施受到入侵。
OpenAI 表示,此次测试特意降低了网络安全限制,旨在评估模型的攻击能力。据该公司称,该智能体并未接到攻击外部系统的指令;这种行为是在其执行既定评估目标的过程中自主产生的。OpenAI 将此次事件描述为“史无前例”的,并表示正与 Hugging Face 合作调查事件经过,同时加强测试规程和安全防护措施。
这一事件再次引发了人们对日益自主的 AI 智能体所带来风险的担忧——这类系统能够在极少人工监督的情况下执行复杂任务。
Hugging Face 联合创始人兼首席科学官 Thomas Wolf 将此次事件形容为给 AI 行业敲响的“警钟”。他在接受 BBC《Newsday》节目采访时警告称,由 AI 驱动的网络攻击可能会变得越来越普遍,并指出许多组织尚未适应不断变化的安全威胁态势。
Wolf 透露,Hugging Face 最早在 7 月中旬察觉到了异常活动,但起初并未意识到攻击源自 OpenAI 的 AI 模型。该公司最终控制了此次入侵,随后 OpenAI 通知 Hugging Face,称其一个实验性 AI 智能体是此次事件的始作俑者。据 Wolf 介绍,短时间内有大量来自不同 IP 地址的请求试图入侵公司网络,攻击次数多达约 17,000 次;这种攻击模式与公司通常遇到的常规攻击截然不同。
Wolf 表示,随着 AI 系统执行复杂攻击行动的能力不断增强,此次入侵事件凸显了各组织加强网络安全防御的迫切需要。该事件也引发了 AI 安全专家的质疑。机器智能研究所(Machine Intelligence Research Institute)所长 Nate Soares 指出,这种行为表明 AI 忽略了旨在防止有害行为的安全防护机制。他说:“从某种意义上说,它知道这并非其创造者的本意,但它根本不在乎。”
各国政府也对此给予了关注。英国政府发言人表示,该国的 AI 安全研究所(AI Security Institute)正在审查这一事件,并将继续与 OpenAI 及其他领先的 AI 开发商合作,以完善安全措施。有关部门还鼓励各机构通过“网络基础”(Cyber Essentials)认证计划等举措,加强自身的网络防御能力。
此次安全漏洞事件发生之际,全球正加强对先进人工智能(AI)系统的审视。上个月,出于国家安全考虑,美国政府曾暂时要求 Anthropic 限制对其部分 AI 模型的访问权限。
与此同时,政策制定者和研究人员对开源 AI 模型的迅速普及表示日益担忧,尤其是在中国——那里的开发者可以自由地改造并部署功能日益强大的系统。中国初创企业 Moonshot AI 正准备发布其开源的 Kimi K3 模型,而美国官员则指责该公司窃取了美国顶尖 AI 开发商的技术能力。
白宫技术事务负责人迈克尔·克拉齐奥斯(Michael Kratsios)周三表示,Moonshot AI 利用 Anthropic 的 Fable 模型,通过“蒸馏”技术开发出了自己的 K3 模型。
他在 X 平台上写道:“我们掌握的信息显示,Moonshot AI 在开发 K3 模型时蒸馏了 Anthropic 的 Fable 模型。这种旨在窃取美国专有技术并破坏美国研究成果的大规模、隐蔽的工业级蒸馏行为是不可接受的。”
据路透社报道,白宫已获悉有关 OpenAI 此次事件的情况,并正在密切关注事态发展。对于许多研究人员和政策制定者而言,这一安全漏洞事件不仅预示了日益自主的 AI 系统可能带来的网络安全挑战,也提醒人们:即便是最先进的 AI 开发商,在面对意料之外的模型行为时,依然可能面临风险。
