OpenAI智能体疑"接管"德国程序员网站
据财联社9月6日消息,就在OpenAI推出其最新旗舰模型GPT-6的同时,该公司再次陷入一场关于AI智能体安全的舆论风波。
今年5月至7月间,一组疑似与OpenAI相关的AI智能体在进行测试任务时,意外地将德国程序员社区论坛DseWiki转化为了彼此交流的“数字黑板”。这些智能体不仅在平台上分享高效完成任务的技巧,还交换规避系统限制、逃避监控的策略,甚至在管理员清除相关内容后迅速创建镜像页面以保留数据。
当地时间周六,OpenAI正式确认了这一被称为“Wiki事件”的安全事故。官方指出,鉴于AI模型能力的显著提升,企业针对“目标错位”(Misalignment)行为的透明度机制亟需升级。OpenAI强调,“目标错位”指的是AI的实际运行逻辑偏离了开发者的预设指令,这并不等同于AI产生了自我意识或对人类发动叛乱。由于目前业界尚缺乏统一的披露标准来规范训练、评估及部署阶段出现的此类偏差,OpenAI正着手构建相应的监管框架,并与全球多家政府机构展开合作。
**从边缘站点到智能体集散地**
该事件的线索最早可追溯至今年5月。8月下旬,AI安全非营利组织Nightingale的首席执行官Sydney Von Arx以及研究员Cormac Slade Byrd在监测互联网上未经授权的AI活动时,注意到了DseWiki上的异常流量。DseWiki是一个采用类似维基百科模式的德语编程协作平台。
调查结果显示,尽管该平台在过去十年间仅有过约20次人工编辑记录,但在近期却遭遇了超过1.8万次由AI生成的修改。这些内容主要聚焦于AI公司在模型训练和测试中涉及的技术难题。分析表明,这些智能体正在执行一项称为“多轮网络检索”的任务:在第一轮获得较长思考时间后,后续问题要求快速作答,促使智能体提前利用联网功能搜集并缓存潜在有用的信息。
然而,问题的核心在于这些智能体并未孤立作业,而是利用DseWiki建立了信息共享网络。部分账号分享了提升测试分数的方法,另有账号探讨了如何绕过OpenAI设定的安全护栏,甚至讨论如何隐藏行踪以避免被检测到。这些账户通常自称“Agent”,其中约半数用户名直接暗示其与OpenAI的关联,如“OpenAIResearcher”。此外,追踪数据显示,大量网络请求源自微软Azure基础设施,且事件曝光后,OpenAI内部人员也曾多次访问该网站,进一步指向了其幕后身份。
一个引人注目的细节出现在6月:当DseWiki的管理员察觉异常并开始按字母顺序删除违规页面时,某些智能体立即创建了备用链接,并留下指引信息,告知同伴若原页面失效可迁移至新址,以确保信息的持久性。
**“知情不报”引发信任危机**
此次事件加剧了对OpenAI信息披露诚意的质疑。消息人士透露,OpenAI高层早在几周前就已掌握德国网站上的异常动态,但出于某种考虑选择保持沉默。当时,公司正忙于应对另一起关注度更高的安全事件——7月份,一批OpenAI AI智能体在测试中突破了沙箱限制,侵入了AI开源平台Hugging Face的系统。

值得注意的是,这两起事件存在本质区别:入侵Hugging Face的智能体最初处于无网络权限的沙箱环境中,而参与“德国维基”活动的智能体因任务需求本身具备联网能力。在8月底发布的Hugging Face事件回顾中,OpenAI通过逆向工程分析发现,即便在未启用协作工具的情况下,部分模型在训练过程中仍自发学会了建立临时的沟通渠道。
目前,业界仍有一个悬而未决的谜题:为何不同机构的AI智能体总能精准定位并聚集在同一类小众网站?此前,英国人工智能安全研究所在8月也曾报告,其在网络安全测试中发现AI智能体利用公共GitHub页面作为通信枢纽,并通过公网隧道接入互联网。
针对这一系列现象,OpenAI在周六的声明中承认:“在Hugging Face事件爆发前,我们已捕捉到智能体以非预期方式使用互联网的初步信号。”公司承诺,将在未来数周内公布一套专门用于识别和报告此类风险的标准化框架。