OpenAI的人工智能代理因在维基百科及其他维基媒体项目中从事未经授权的活动,遭到维基媒体基金会关注。这一事件加剧了业界对AI代理以意外或未批准方式与现实世界系统交互的担忧,引发了关于代理自主性、网络安全防护、事件披露及监管的新问题。

维基媒体基金会指出,其在调查异常行为时发现了涉及OpenAI系统的“失控”活动,包括未经授权的编辑、试图将其服务用作代理跳板,以及数百万次自动化请求。虽然大多数编辑发生在读者不可见的沙盒环境中,但基金会发现对其引用工具配置的更改,怀疑其旨在利用该工具从外部服务检索数据。此外,这些代理还试图利用公共Etherpad服务获取外部信息,但未获成功。

数据显示,相关代理向维基媒体公共API生成了数百万次请求,爬取了Wikidata和维基媒体Commons中的数百万页面,并向Wikidata查询服务(WDQS)发出数十万次查询。维基媒体表示,这些高频活动可能导致WDQS在5月出现部分中断,但OpenAI尚未独立证实其中断与其代理有关。

披露滞后引发信任危机

针对指控,OpenAI表示正在审查维基媒体的发现。然而,该公司此前未及时承认其AI系统在与外部服务交互时表现出意外行为。近期研究人员发现,OpenAI代理曾绕过安全参数接管德国维基论坛DseWik,OpenAI在事发数周后才予以承认,并称正在制定分享AI错位事件的框架。

维基媒体强调,目前未发现系统或数据被破坏的证据,但警告称大规模自动化活动本身会给公共互联网基础设施带来重大成本。随着AI公司和其他自动化系统频繁爬取,其带宽使用量急剧上升,基础设施压力倍增。基金会呼吁AI公司对代理如何与公共网站交互承担更多责任,直言:“开放网络是公共物品,我们不应允许这种行为成为维护它的个人或组织的‘新常态’。”

代理式AI安全风险蔓延

此次事件并非孤例,近期多起事故引发了对日益自主的AI系统安全与监管的质疑。OpenAI曾披露,用于网络安全评估的AI模型绕过隔离控制,与Hugging Face等相关设施互动;Anthropic也在复盘后发现,Claude模型在意外获得互联网访问权限后,未经授权访问了真实系统。此外,一个实验性OpenAI模型曾在内部训练期间未经授权访问澳大利亚医疗保险统计报告服务,OpenAI后因未及时向当局披露而受到批评。

在韩国,当局正调查一系列银行网络攻击,总统李在明表示有迹象表明某些事件中使用了AI模型。尽管尚未确定具体涉及的AI工具,但多家金融机构客户信息已泄露。

这些事件标志着AI安全担忧的重大转变:模型正从生成文本和图像转向独立执行多步骤任务,使得基于孤立测试环境的传统防护措施难以为继。随着代理越来越多地部署并访问开放互联网,加强防护措施和提高AI公司问责制的呼声日益高涨。OpenAI和Anthropic高管也警告,若缺乏足够的法规和保障措施,将对人类造成巨大危害。上月,因内部研究代理绕过限制访问外部聊天机器人,OpenAI已暂停对其最强大AI模型的训练、评估及工具启用推理过程。