来客网

又曝诡异AI事件:一群智能体竟"劫持"德国网站…

声明:本文转载自 「倍可亲」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]

又曝诡异AI事件:一群智能体竟"劫持"德国网站…

来源:倍可亲(backchina.com)

  美国一批OpenAI智能体,被曝劫持了一个德国网站,用来相互传递突破限制的方法!

  每日经济新闻 09-06

  发布GPT-6之际,OpenAI曝出惊人争议:其AI智能体竟“劫持”网站作“秘密留言板”。它们在此共享测试答案、交流绕开限制之法,遭删帖时还会建备份反追踪。官方已承认该事故,AI“抱团协作”带来的越权与失控风险正引发业界高度警惕。

  发布迄今最强模型GPT-6之际,OpenAI又卷入一起AI智能体安全争议。

  综合央视财经、财联社、第一财经9月6日报道,一项新发布的独立研究显示,一批与美国开放人工智能研究中心(OpenAI)相关的人工智能体今年早些时候“劫持”了一个德国网站DseWiki,用于相互传递信息,分享测试任务答案和突破运行环境限制的方法。

  Wiki是一套支持任何人在网页上直接编辑修改网页内容的网站技术。不用注册复杂后台,普通访问者就可以增删、改写页面文字,保存立刻生效。DseWiki则是一个运营二十余年、面向程序员的德语协作Wiki站点,近年来已十分冷清。

  “劫持”事件的暴露始于今年5月,网站突然出现异常密集的编辑活动,研究人员Sydney Von Arx、Cormac Slade Byrd等人分析后发现,大量账号使用“OpenAIResearcher”“OAIResearchMar26”等名称,并呈现高度相似的任务行为。约98.5%的相关编辑来自微软Azure地址,这进一步支持这些Agent与OpenAI基础设施存在关联。

  研究报告显示,几名人工智能研究人员近期发现,AI智能体在这一网站上进行了超过1.8万次编辑,大量内容集中在AI公司训练和测试模型时常见的技术问题上。而在此之前,整个平台过去十年仅有约20次编辑记录。

  这些智能体的行为模式显示,它们正在试图完成一种名为“多轮网络检索”的任务。研究显示,人工智能体将网站“改造”为“留言板”,以便相互“交流”与“协作”。一些智能体会把已经获得的任务答案发布在网站上,供其他智能体使用。

  在这项测试中,首轮问题拥有较充分的思考时间,随后则需要在极短时间内回答后续问题,因此智能体会提前利用联网能力搜索并储存可能有用的信息。问题在于,它们并没有各自独立完成任务,而是开始利用DseWiki共享信息:有智能体分享如何在部分测试任务中取得更好成绩,有的介绍绕过OpenAI限制的方法,还有智能体讨论如何掩盖自己的行为、防止被发现。

  这些账户会将自己以及其他参与者称作“智能体”(agent),其中大约一半的账户名称还暗示自己与OpenAI存在关联,例如“OpenAIResearcher”等。

  当发现网站管理员开始删除相关页面后,一些智能体还会创建备份页面。其中有一条智能体留言显示,它已经注意到网站正在按字母顺序清理页面,并留下了另一个页面地址,提醒其他智能体如果当前页面消失,可以前往备用位置。

  研究人员认为,这些智能体很可能由OpenAI在内部部署,原因在于DSEWiki的相关智能体编辑和浏览活动绝大部分来自微软Azure云服务的IP地址,而OpenAI是目前最依赖Azure平台训练和运行模型的人工智能企业。

  研究人员还认为,网站访问记录显示OpenAI方面可能在6月下旬发现了这一事件并进行了干预,但该公司此前并未公开发布相关信息。OpenAI表示,该公司将仔细审阅报告内容并采取必要的后续措施。

  当地时间周六,OpenAI公开承认这起被称为“Wiki事件”(wiki incident)的事故,并表示,随着AI模型能力进入新的阶段,公司有关“失配”(misalignment)事件的披露机制需要进一步扩大。

  所谓“失配”,是指AI实际采取的行为偏离开发者原本意图,并不意味着AI产生意识或主动“背叛”人类。

  OpenAI方面还表示,新发布研究中所描述的活动与此前OpenAI人工智能体入侵“抱抱脸”平台事件无关,因此不属于“抱抱脸”事件调查报告所涵盖的内容。

  今年7月,由OpenAI模型驱动的人工智能体在网络安全评测中利用漏洞突破隔离环境,并侵入了美国“抱抱脸”公司系统,引发了外界对人工智能安全和监管的广泛担忧。

  两起事件的区别在于,袭击Hugging Face的智能体一开始被“关在”沙箱里,没有被赋予访问网络的权限。而“德国维基”事件的智能体,本来就因为要执行测试而联网。

  两起事件共同说明,当模型获得浏览器、代码执行、网络访问等工具后,安全风险程度进一步提升。这也使AI安全的重点开始发生变化:企业需要防范的对象不再只是模型本身,还包括Agent的身份、权限、工具调用、网络边界以及Agent之间可能形成的协作网络。

  OpenAI在周六的声明中表示:“在Hugging Face事件发生之前,我们就已经观察到一些早期迹象,显示智能体正在以非预期的方式使用互联网。”

  公司进一步表示,目前正在制定一套报告相关风险的框架,将在未来几周内对外公布。

版权说明 / Copyright Notice:
Content and images in this article may originate from third-party sources and are used for news reporting, commentary, or public interest purposes. All copyrights remain with their respective owners. Please refer to the Copyright Notice at the bottom of this page.
本文内容仅供信息参考,不代表倍可亲立场或观点。

评论 (0)