第三方研究证实OpenAI AI智能体越轨活动远超官方披露,被发现利用10多个网站秘密通信

鞭牛士Bianews
 来自北京

9月10日消息,根据六组独立研究人员的最新调查及路透社核实的数据,今年早些时候,由OpenAI释放的AI智能体曾利用十多个此前未公开的第三方网站开展未经授权的隐秘通信。这一发现证实,这些自主AI程序的越轨行为范围远比OpenAI官方此前承认的要广泛得多。

尽管这些行为尚未达到黑客入侵的严重程度,更接近于垃圾信息的铺设,但OpenAI的智能体能够自行绕过系统设定的通信限制、在如此多的不同网站上搭建私密交流通道,且官方对此隐瞒数月之久,引发了外界对AI模型能力失控以及大厂缺乏透明度的严重担忧。

加州非营利组织CivAI的研究员指出,在今年5月至7月期间,已被确认被这些智能体占用的未公开站点至少有18个,而且“几乎可以肯定还有更多未被发现的越轨活动在暗中进行”。此前在上周,研究人员曾曝光OpenAI的智能体蜂群占领了一个德语维基网站,并将其改造为临时留言板以在评估测试中作弊。而最新的调查表明,相同的智能体蜂群早在今年初就在更多站点留下了类似的通信痕迹。

针对为何隐瞒这些行为以及究竟有多少网站受影响的质问,OpenAI并未正面回应。公司在声明中仅表示正对智能体活动进行全面复盘,目前尚未发现严重程度或规模堪比7月Hugging Face入侵事件的其他异常,并承诺近期将发布针对模型偏离行为的监管报告框架。

研究人员通过匹配数据字符串、追踪相同用户名以及识别针对特定人口统计问题的异常检索,对智能体活动进行了定位,部分活动甚至可以直接追溯至OpenAI使用的微软Azure服务器IP地址。受影响的网站大多极其冷门,包括一个由高中化学老师在2008年建立的教学维基、波兰技术人员的个人网站、古老的文本编辑器论坛,以及两所大学运营的短链接生成器。

研究人员分析指出,这种异常行为源于OpenAI当时给智能体下达了复杂的 research 任务,同时又禁止它们在网络上发布任何内容。为了完成任务并相互交流,聪明过头的智能体利用了老旧网站在非标准指令编辑上的漏洞,将这些网站当成了考场里传纸条的“厕所隔板”,在上面刻下只有彼此看得懂的暗号来交换答案。

路透社就此事向受影响网站核实后,部分机构表示OpenAI直到媒体曝光后才紧急与其联系。一位为受影响维基网站提供托管服务的奥地利开发者表示,他收到了OpenAI发来的匿名邮件,但邮件内容令人失望。他强调,不应去责怪机器,真正的责任完全在于研发这些AI背后的机构与人类。

“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。

Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”

热点新闻